{"as_of":"2026-08-08T11:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a5029754ce0f17d3c276ce82df3d86c64f9f30a05007081927f534fa94f49ad4","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:05:03.227528Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:05:03.141073Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:05:03.298932Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"cited_work":{"arxiv_id":"2506.00636","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00636","snapshot_observed_at":"2026-08-07T12:05:03.298932Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","venue":"cs.CL","work_id":"a1c0f161-a8e5-4ce3-ac29-e6117bffe486","year":2025},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.141073Z"},"links":{"cited_paper":"/paper/2506.00636","citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:ad8e49c1a9fdfcf6faa0b60762ff22f4908df001b964d5795fe39e0bbee2146f","observation_id":"8a1891f3-1f4c-4d7d-881a-20ccc08b0562","resolution":{"observed_at":"2026-08-07T12:05:03.301955Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00636/citation-record","integrity":"/paper/2506.00636/integrity","json":"/paper/2506.00636/citation-record.json","paper":"/paper/2506.00636"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"cited_work":{"arxiv_id":"2506.00636","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00636","snapshot_observed_at":"2026-08-07T12:05:03.298932Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","venue":"cs.CL","work_id":"a1c0f161-a8e5-4ce3-ac29-e6117bffe486","year":2025},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.141073Z"},"links":{"cited_paper":"/paper/2506.00636","citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:ad8e49c1a9fdfcf6faa0b60762ff22f4908df001b964d5795fe39e0bbee2146f","observation_id":"8a1891f3-1f4c-4d7d-881a-20ccc08b0562","resolution":{"observed_at":"2026-08-07T12:05:03.301955Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.505263Z","title":null,"venue":null,"work_id":"ac48adf4-9f28-4e01-94e9-65c0997f8785","year":null},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.144779Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:bafc2ccfe0460fccdfbf1bcf3741308945f00fb1af441f64823a9b9a1f9d04e8","observation_id":"e1e4d5c6-e01b-496e-95d3-ba1f7f2f1334","resolution":{"observed_at":"2026-08-07T12:05:03.508277Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.497403Z","title":null,"venue":null,"work_id":"197d12d6-7a42-48eb-9be2-a419b4ffa6de","year":null},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.147970Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:efbc3f739dde3dd4d3690a55bfd267858b461c596903e94a4a3fb6961658bb09","observation_id":"fc2fbd6b-5810-4365-bb28-9d08b6151617","resolution":{"observed_at":"2026-08-07T12:05:03.500041Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.489045Z","title":"The process is outlined in the following sections: data pre-processing, evaluation metrics, and speech recognition experimental results","venue":null,"work_id":"79413253-ebfe-4445-9adf-3a331e9d47db","year":null},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.151062Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:57f687b1fef1b3a848b353e19a47742b6aa2b304cdb977bb3f73df89879ec798","observation_id":"bb5d3e38-29c8-4642-b525-42dc8efed1d8","resolution":{"observed_at":"2026-08-07T12:05:03.492201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.480866Z","title":null,"venue":null,"work_id":"c6dc3eee-6192-4dbc-a396-fcfe184bc920","year":null},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.155247Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:d0f20a05b55c5fef2557ad66b7fa7b85ad0c43a388a3067f9c5c48ba946adc61","observation_id":"282a035e-c133-47e8-82a2-9baf33bbfe90","resolution":{"observed_at":"2026-08-07T12:05:03.483692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.472607Z","title":null,"venue":null,"work_id":"6262e5e4-c75a-47f6-84cf-a23e400ec078","year":null},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.158100Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:c3e8af17bd8c0205b15deb0e67e30eb85c2d7dc51bc4b0003c30aeff4f0e3602","observation_id":"584d35fc-c01d-4a1f-833a-0634ffdc37bc","resolution":{"observed_at":"2026-08-07T12:05:03.475684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.08272","last_updated":"2018-05-21T20:00:49Z","snapshot_observed_at":"2026-07-06T06:40:24.763407Z","submitted_at":"2018-05-21T20:00:49Z","title":"The Sounds of Cyber Threats","version":1},"cited_work":{"arxiv_id":"1805.08272","doi":null,"metadata_source":"pith","pith_arxiv_id":"1805.08272","snapshot_observed_at":"2026-08-07T12:05:03.287985Z","title":"The Sounds of Cyber Threats","venue":"cs.CR","work_id":"a7b0edd0-e609-4074-9316-10006ec7ad68","year":2018},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.161082Z"},"links":{"cited_paper":"/paper/1805.08272","citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:fa6f38527eb7638a1d3f411eec16b40b7641cd1e7797c341becab8b72efdfdad","observation_id":"2c828336-73ec-4068-b1dd-cbe31a96f438","resolution":{"observed_at":"2026-08-07T12:05:03.290876Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.463652Z","title":"Audio-based toxic lan- guage classification using self-attentive convolutional neural net- work,","venue":null,"work_id":"6450ba8f-cec0-49c3-b36f-d3aae3c78eb1","year":2021},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.164369Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:a3616067526c26eb28ada0a09c96532d97fdf3f956c482a1b46d74512b7fc27b","observation_id":"e0a19c19-706e-4291-9215-f19d090345ce","resolution":{"observed_at":"2026-08-07T12:05:03.466836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.454385Z","title":"Linguistic analysis of toxic behavior in an online video game,","venue":null,"work_id":"498b2174-29dc-4367-a520-b96a6b6bff7b","year":2015},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.167350Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:7a363a98578dd0e81691a253fc3c868214751fb0dc96da2ad6975405cb315e9f","observation_id":"601813b3-5b84-4a08-8102-d213c4359ff4","resolution":{"observed_at":"2026-08-07T12:05:03.457438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.444863Z","title":"The influence of violent media on children and adolescents: A public-health approach,","venue":null,"work_id":"fb95e9c6-c5b7-4eaf-b9b1-071db2a30ac3","year":2005},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.170465Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:621dcf8a7968f9024e7f7144603e9076f5f0162fce441d7ca2620dcd4ddeb6c3","observation_id":"9eaa9569-0c6b-4c26-8a4e-60fbc12876cf","resolution":{"observed_at":"2026-08-07T12:05:03.448239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.436058Z","title":"An exploratory analysis of the relation between offensive language and mental health,","venue":null,"work_id":"1e5c8a7d-97ee-48c1-b16d-4f6f76ea1900","year":2021},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.173194Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:6b01dc2ecd640b920cae4b56ae84f666a7769a57fa4d1a1f09abcec8ecf08fc9","observation_id":"b48be41c-63eb-4a03-999b-62cfcb001f08","resolution":{"observed_at":"2026-08-07T12:05:03.439072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41386-021-01069-4","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.256122Z","title":"Choosing appropriate language to reduce the stigma around mental illness and substance use disorders,","venue":null,"work_id":"dd95f5a4-ca98-4672-a310-62669f5842ad","year":2021},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.176436Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:2e3a48cb083842ae3ea4190d4ed63137ff62e8246086abf689e8cf9632009470","observation_id":"a044bc26-d0b9-492f-a130-2ef2e682e2ed","resolution":{"observed_at":"2026-08-07T12:05:03.259911Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.427399Z","title":"Exploring the distinctive tweeting patterns of toxic twitter users,","venue":null,"work_id":"d1748111-248f-4972-afa5-6340b9c10ef1","year":2023},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.179409Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:7135d24aa6b374f5207e2c8f8ebf217497f4ef7072f3eea257a5e155db173d2f","observation_id":"9bf5e81a-97de-4271-933d-0d434d35fcaa","resolution":{"observed_at":"2026-08-07T12:05:03.430288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.418694Z","title":"Detoxy: A large-scale multimodal dataset for toxicity classifica- tion in spoken utterances,","venue":null,"work_id":"a7ca2381-1cd0-4815-840d-72133595247c","year":2022},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.182238Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:7b77567454b043390459bb6a4d9f4a952dc3f92b47ab4d35d02ec7c4d662434f","observation_id":"23013af6-4c1c-43d8-9353-b706fb5cd854","resolution":{"observed_at":"2026-08-07T12:05:03.421683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.409760Z","title":"MuTox: Universal MUltilingual audio-based TOXicity dataset and zero- shot detector,","venue":null,"work_id":"9fa91742-2867-4abb-a4cb-e6f03373d43f","year":2024},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.184864Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:a7008cc686b735ce2fe2deb73d721e6632e550c1a23a0010dc0d23bb3140f59a","observation_id":"2fd4218d-b510-4b72-818e-d984a27a501b","resolution":{"observed_at":"2026-08-07T12:05:03.413069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11408","last_updated":"2023-04-22T13:45:38Z","snapshot_observed_at":"2026-07-06T15:18:45.940190Z","submitted_at":"2023-04-22T13:45:38Z","title":"Lightweight Toxicity Detection in Spoken Language: A Transformer-based Approach for Edge Devices","version":1},"cited_work":{"arxiv_id":"2304.11408","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.11408","snapshot_observed_at":"2026-08-07T12:05:03.276089Z","title":"Lightweight Toxicity Detection in Spoken Language: A Transformer-based Approach for Edge Devices","venue":"cs.SD","work_id":"66152b50-5260-4a56-842b-53b2299b15d7","year":2023},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.187654Z"},"links":{"cited_paper":"/paper/2304.11408","citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:7786363be05c5d5c264c29347b22681ec6f10b30941340762307080390578a6a","observation_id":"9553aa5d-1e7e-4bad-88fd-00d5589a65ba","resolution":{"observed_at":"2026-08-07T12:05:03.279574Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.400985Z","title":"Enhancing multilingual voice toxicity detection with speech-text alignment,","venue":null,"work_id":"428c7e49-2747-4f11-9292-8a37842584e9","year":2024},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.190570Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:d198d3748699b7a77cfc41f969a5dabbaa3714aef67f31146b5cff088aa39d9b","observation_id":"765ba09d-117d-4692-b12e-a11afd668e06","resolution":{"observed_at":"2026-08-07T12:05:03.403902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-79457-6_49","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.245761Z","title":null,"venue":null,"work_id":"a813c6a4-5522-48df-ba53-4bd65c07f54e","year":2021},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.193220Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:1935409c3f57cfb011010c5952ca1034d8250c36023dbe4c1bcbbbdd11917dcb","observation_id":"fc62ed87-eb80-4177-a043-365fc6870659","resolution":{"observed_at":"2026-08-07T12:05:03.250183Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.391755Z","title":"A large-scale dataset for hate speech detection on vietnamese social media texts,","venue":null,"work_id":"5c80a182-f464-45f6-8c67-cc6dbc3d64f8","year":2021},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.195986Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:f8fc02ee4a783c116e87e0d11d547374a35be2fe9895db9a84040df8f4a72abe","observation_id":"6ca94240-3683-4e59-8bc6-6983bf466a1a","resolution":{"observed_at":"2026-08-07T12:05:03.395573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.383078Z","title":"ViHOS: Hate speech spans detection for Vietnamese,","venue":null,"work_id":"0286f57c-4461-4ab7-ba2a-a3439d98eaa9","year":2023},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.199708Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:6505debeecdb146c332cfba644ceb5c8aec78b1119b3a18abdd2239205d5371b","observation_id":"9fe3260f-4bb9-443e-a030-6c128f2efc2e","resolution":{"observed_at":"2026-08-07T12:05:03.385999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.374075Z","title":"ViHateT5: Enhancing hate speech detection in Vietnamese with a unified text-to-text transformer model,","venue":null,"work_id":"8aaf290b-7076-47ac-b0fb-86730bded55b","year":2024},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.202438Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:ddc5898a11063c105424fcf29b7f855ce67c321a32c245f74587f9229e99dedd","observation_id":"fe09ce50-4340-4f3f-805d-84bcabb35fa1","resolution":{"observed_at":"2026-08-07T12:05:03.377160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.365541Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":"ee3fcae6-d94c-4216-8333-32aac822c396","year":2023},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.205503Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:79cb0b68a750947a72b967b9b4b2d51fa7d7f39335ada75d1909a2bc8d138960","observation_id":"76572e13-54fc-46e9-905c-8d283365327d","resolution":{"observed_at":"2026-08-07T12:05:03.368473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.208155Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.208155Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:2a7dbe8568bd92a80b82535744f0b6d57e1d75b3d9947bf5f33d095e628e99ad","observation_id":"d1520d0c-5e29-440e-b38f-c494d8c52efe","resolution":{"observed_at":"2026-08-07T12:05:03.208155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.351231Z","title":"PhoWhisper: Auto- matic Speech Recognition for Vietnamese,","venue":null,"work_id":"1f5f03bb-245d-471e-83b0-3a2f5f6d2a52","year":2024},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.210818Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:74cd9156c764d7e3922fb7e2cb98559e9ad4877d9a1d8073f33b094947d043b6","observation_id":"d0ae4b93-1e95-4d97-b11f-4d4e3186235c","resolution":{"observed_at":"2026-08-07T12:05:03.354799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.342399Z","title":"Unsupervised cross-lingual representation learning at scale,","venue":null,"work_id":"d54c8332-b3db-4a01-a629-b4b899ca9035","year":2020},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.213464Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:e6f741693306ecd2c00316a7d547592a7b5593bff024028d484badc5e125f42d","observation_id":"c379f1c8-4b2f-44f3-8799-0cfedcdfaad3","resolution":{"observed_at":"2026-08-07T12:05:03.345270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.334259Z","title":"BERT: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":"9292d648-eca9-46ef-b901-57b6cb765c2a","year":2019},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.216252Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:fa959be82906b73c7016cb506a0df7676536d3293819e5a8f949ca9a0bfaefb1","observation_id":"88481b36-ea3f-4be8-919b-74e849601a30","resolution":{"observed_at":"2026-08-07T12:05:03.337261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-07T12:05:03.219241Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.219241Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:ba3887c7af8c60caac2ad58ceb6323d77c34cdae12e367789ec5cd58bae8fe7d","observation_id":"4328bd90-4d4f-4dfc-a110-81e6ce1e0c46","resolution":{"observed_at":"2026-08-07T12:05:03.219241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.324733Z","title":"PhoBERT: Pre-trained language models for Vietnamese,","venue":null,"work_id":"fec1416f-2f59-4d63-b052-e41da49a5466","year":2020},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.222062Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:0e149250905f9251e77f5a157b3dae28c3e154facce8d0ad61c32b7a6d2f3a49","observation_id":"527822ff-6376-4ce3-a254-99cf9691e5a9","resolution":{"observed_at":"2026-08-07T12:05:03.328697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.316761Z","title":"ViSoBERT: A pre-trained language model for Vietnamese social media text processing,","venue":null,"work_id":"8ddacfc9-bdb5-49b6-a14b-620078bf70a3","year":2023},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.224863Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:c98f1a872ddad839b074b35ad36642ab6503231d43965f546516dcff4410edcb","observation_id":"b2116d6d-accf-4f4b-be0e-20c920601f98","resolution":{"observed_at":"2026-08-07T12:05:03.319492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:03.308302Z","title":"VLUE: A new benchmark and multi-task knowledge transfer learning for Vietnamese natural language understanding,","venue":null,"work_id":"65a1bf0e-7752-4c6b-8449-1b88164f98cb","year":2024},"citing_paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.227528Z"},"links":{"citing_paper":"/paper/2506.00636"},"observation_digest":"sha256:97459834958844622a64a4ee9861b87ef9e85e887f2005dc1f4e2a3ab3b1f2ff","observation_id":"ad2e927f-9ba8-4197-a31c-522f3c8784d5","resolution":{"observed_at":"2026-08-07T12:05:03.311260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00636","last_updated":"2025-05-31T17:01:18Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T11:59:01.739560Z","submitted_at":"2025-05-31T17:01:18Z","title":"ViToSA: Audio-Based Toxic Spans Detection on Vietnamese Speech Utterances"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":5,"verified_fuzzy":19},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 1 inbound Pith citation observation for arXiv:2506.00636."}