{"as_of":"2026-08-13T22:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ef44b97e90dd8f619a666fcce68a25ff6cdc7e36a41bf113d6c183c8b796c368","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T05:44:30.041044Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T03:15:17.056764Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2106.12914","last_updated":"2021-09-28T09:06:33Z","snapshot_observed_at":"2026-08-13T18:58:45.544887Z","submitted_at":"2021-06-23T08:28:59Z","title":"Speech is Silver, Silence is Golden: What do ASVspoof-trained Models Really Learn?","version":4},"cited_work":{"arxiv_id":"2106.12914","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.12914","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech is silver, silence is golden: What do ASVspoof-trained models really learn?","venue":null,"work_id":"e113186f-49e4-4a5b-a25c-63c2cf1a386b","year":2021},"citing_paper":{"arxiv_id":"2401.09512","last_updated":"2026-05-18T13:28:38Z","snapshot_observed_at":"2026-07-06T17:17:03.447619Z","submitted_at":"2024-01-17T15:09:02Z","title":"MLAAD: The Multi-Language Audio Anti-Spoofing Dataset","version":10},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-24T04:34:59.205522Z"},"links":{"cited_paper":"/paper/2106.12914","citing_paper":"/paper/2401.09512"},"observation_digest":"sha256:7174acf8efc51aa4a5cb42c9f732bb784470cf1871c366848f9fa85436d0f317","observation_id":"b5146934-6c6f-4c46-971e-98b7caa7daa7","resolution":{"observed_at":"2026-05-24T04:36:00.859108Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.12914","last_updated":"2021-09-28T09:06:33Z","snapshot_observed_at":"2026-08-13T18:58:45.544887Z","submitted_at":"2021-06-23T08:28:59Z","title":"Speech is Silver, Silence is Golden: What do ASVspoof-trained Models Really Learn?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.12914","snapshot_observed_at":"2026-08-12T05:44:30.041044Z","title":"M ¨uller, Franziska Dieckmann, Pavel Czempin, Roman Canals, and Konstantin B ¨ottinger","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00175","last_updated":"2025-05-29T14:44:11Z","snapshot_observed_at":"2026-08-12T20:40:20.763413Z","submitted_at":"2024-11-29T18:58:20Z","title":"Circumventing shortcuts in audio-visual deepfake detection datasets with unsupervised learning","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T05:44:30.041044Z"},"links":{"cited_paper":"/paper/2106.12914","citing_paper":"/paper/2412.00175"},"observation_digest":"sha256:9789aa9f9f0775949af94e058a09b546abe55d953030f71cc08fea8036102ea4","observation_id":"5ff8c039-2b88-415d-81d0-c3259f4fd4a5","resolution":{"observed_at":"2026-08-12T05:44:30.041044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.12914","last_updated":"2021-09-28T09:06:33Z","snapshot_observed_at":"2026-08-13T18:58:45.544887Z","submitted_at":"2021-06-23T08:28:59Z","title":"Speech is Silver, Silence is Golden: What do ASVspoof-trained Models Really Learn?","version":4},"cited_work":{"arxiv_id":"2106.12914","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.12914","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech is silver, silence is golden: What do ASVspoof-trained models really learn?","venue":null,"work_id":"e113186f-49e4-4a5b-a25c-63c2cf1a386b","year":2021},"citing_paper":{"arxiv_id":"2502.20427","last_updated":"2026-05-13T15:54:56Z","snapshot_observed_at":"2026-08-13T21:23:12.904835Z","submitted_at":"2025-02-27T12:26:25Z","title":"DeePen: Penetration Testing for Audio Deepfake Detection","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-23T02:43:04.745094Z"},"links":{"cited_paper":"/paper/2106.12914","citing_paper":"/paper/2502.20427"},"observation_digest":"sha256:dfbb8e0deb3a3952f88dbc0bc0263c7c347d3708804365a82130df56eaa8e22a","observation_id":"9e9bd389-bc5e-4a08-afdc-686f54d94c39","resolution":{"observed_at":"2026-05-23T02:45:19.464531Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.12914","last_updated":"2021-09-28T09:06:33Z","snapshot_observed_at":"2026-08-13T18:58:45.544887Z","submitted_at":"2021-06-23T08:28:59Z","title":"Speech is Silver, Silence is Golden: What do ASVspoof-trained Models Really Learn?","version":4},"cited_work":{"arxiv_id":"2106.12914","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.12914","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech is silver, silence is golden: What do ASVspoof-trained models really learn?","venue":null,"work_id":"e113186f-49e4-4a5b-a25c-63c2cf1a386b","year":2021},"citing_paper":{"arxiv_id":"2605.00251","last_updated":"2026-04-30T21:32:40Z","snapshot_observed_at":"2026-08-06T03:10:18.640256Z","submitted_at":"2026-04-30T21:32:40Z","title":"Alethia: A Foundational Encoder for Voice Deepfakes","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-09T19:27:59.124425Z"},"links":{"cited_paper":"/paper/2106.12914","citing_paper":"/paper/2605.00251"},"observation_digest":"sha256:bd04b8ec24c3610e43f3036e2087a1425dd2041c2b8b030b1b1bea79a722192d","observation_id":"d350a536-2e4e-4c06-976a-453ad440e1ac","resolution":{"observed_at":"2026-05-11T15:41:30.779331Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.12914","last_updated":"2021-09-28T09:06:33Z","snapshot_observed_at":"2026-08-13T18:58:45.544887Z","submitted_at":"2021-06-23T08:28:59Z","title":"Speech is Silver, Silence is Golden: What do ASVspoof-trained Models Really Learn?","version":4},"cited_work":{"arxiv_id":"2106.12914","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.12914","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech is silver, silence is golden: What do ASVspoof-trained models really learn?","venue":null,"work_id":"e113186f-49e4-4a5b-a25c-63c2cf1a386b","year":2021},"citing_paper":{"arxiv_id":"2605.23201","last_updated":"2026-05-22T03:33:36Z","snapshot_observed_at":"2026-08-13T17:42:32.098429Z","submitted_at":"2026-05-22T03:33:36Z","title":"MixFake: Benchmarking and Enhancing Audio Deepfake Detection in Diverse Real-world Mixed Audio","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-25T03:14:08.880072Z"},"links":{"cited_paper":"/paper/2106.12914","citing_paper":"/paper/2605.23201"},"observation_digest":"sha256:8fc5ddcb1a4a6834ab18d823a68e09daa380bab5564f096ad81bda888ae11103","observation_id":"ae057ebe-36b9-4d35-a7fc-5c27b8dac178","resolution":{"observed_at":"2026-05-25T03:15:17.059650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.12914","last_updated":"2021-09-28T09:06:33Z","snapshot_observed_at":"2026-08-13T18:58:45.544887Z","submitted_at":"2021-06-23T08:28:59Z","title":"Speech is Silver, Silence is Golden: What do ASVspoof-trained Models Really Learn?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.12914","snapshot_observed_at":"2026-08-01T11:03:27.603106Z","title":"Speech is silver, silence is golden: What do asvspoof-trained models really learn?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20023","last_updated":"2026-07-22T11:05:04Z","snapshot_observed_at":"2026-08-10T21:24:37.451923Z","submitted_at":"2026-07-22T11:05:04Z","title":"Layer-Wise Decision Fusion for Fake Audio Detection Using XLS-R","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T11:03:27.603106Z"},"links":{"cited_paper":"/paper/2106.12914","citing_paper":"/paper/2607.20023"},"observation_digest":"sha256:f6bd274501f8048662f0ecaad8936eaec01bd39071aeccd8090ce6c9f9573b76","observation_id":"04b91278-7924-4940-842e-a029f3932e61","resolution":{"observed_at":"2026-08-01T11:03:27.603106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.12914","last_updated":"2021-09-28T09:06:33Z","snapshot_observed_at":"2026-08-13T18:58:45.544887Z","submitted_at":"2021-06-23T08:28:59Z","title":"Speech is Silver, Silence is Golden: What do ASVspoof-trained Models Really Learn?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.12914","snapshot_observed_at":"2026-08-08T11:50:21.141690Z","title":"arXiv preprint arXiv:2106.12914 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05507","last_updated":"2026-08-06T01:19:35Z","snapshot_observed_at":"2026-08-12T15:35:38.693448Z","submitted_at":"2026-08-06T01:19:35Z","title":"AffectDF: The Most Comprehensive Benchmark for Speech Deepfake Detection against Emotionally Expressive Attacks","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-08T11:50:21.141690Z"},"links":{"cited_paper":"/paper/2106.12914","citing_paper":"/paper/2608.05507"},"observation_digest":"sha256:006fa23d648f3bcfef1b9e6f2348b82a7efc881c1e85bf9afc7bbdca9c7f48bf","observation_id":"7631c976-57bd-4421-9c04-22fa68bd1068","resolution":{"observed_at":"2026-08-08T11:50:21.141690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2106.12914/citation-record","integrity":"/paper/2106.12914/integrity","json":"/paper/2106.12914/citation-record.json","paper":"/paper/2106.12914"},"outbound":[],"paper":{"arxiv_id":"2106.12914","last_updated":"2021-09-28T09:06:33Z","latest_version":4,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-13T18:58:45.544887Z","submitted_at":"2021-06-23T08:28:59Z","title":"Speech is Silver, Silence is Golden: What do ASVspoof-trained Models Really Learn?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2106.12914."}