{"as_of":"2026-08-07T03:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea5712ebc29f791ce3907d81d58886b3a909852bdfadd8342ff69485e839837c","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T12:51:14.919171Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T12:51:14.919171Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T07:49:38.734432Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"cited_work":{"arxiv_id":"2606.21735","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.21735","snapshot_observed_at":"2026-07-04T07:49:38.734432Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","venue":"eess.AS","work_id":"24bb9540-05c0-4ab9-8b2e-15cde87fde22","year":2026},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"cited_paper":"/paper/2606.21735","citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:18a284bfb36789283e19739d0f6df6cfc95711f6710780892e73b70682b6842c","observation_id":"5ce5f4d9-7312-43fc-b32f-106d8cd11b68","resolution":{"observed_at":"2026-07-04T07:49:38.736236Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.21735/citation-record","integrity":"/paper/2606.21735/integrity","json":"/paper/2606.21735/citation-record.json","paper":"/paper/2606.21735"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"cited_work":{"arxiv_id":"2606.21735","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.21735","snapshot_observed_at":"2026-07-04T07:49:38.734432Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","venue":"eess.AS","work_id":"24bb9540-05c0-4ab9-8b2e-15cde87fde22","year":2026},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"cited_paper":"/paper/2606.21735","citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:18a284bfb36789283e19739d0f6df6cfc95711f6710780892e73b70682b6842c","observation_id":"5ce5f4d9-7312-43fc-b32f-106d8cd11b68","resolution":{"observed_at":"2026-07-04T07:49:38.736236Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"All data are obtained from publicly available corpora","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:df49bedeb93701a840e3fa872edbe7feb8f92a1ffdac79fc4f195bdb0e0f59ad","observation_id":"690c7806-e9b3-4a57-a26c-e58cc69f7711","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"[ 21], one of the foundational CF detection work","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:e7ef2769ba4f3a4ef336cc47c679ede2a8626c195008ff93f1fbf37c9aa66ead","observation_id":"d4e0aa54-e9e4-4443-8246-7dab263321b4","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"We then detail the proposed framework,BONSAI","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:f006f366d936d1ce39238488d358cc91d414c67513e8416ef8d54a9c8dac0615","observation_id":"24cfae97-fd74-410a-8e33-fefa1bbc1ca7","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:e99cd520db89eb35aeec5c9f56de998297807867dd04957fc97967fbb56fb2c2","observation_id":"78fc723c-67c1-4abc-bfe9-79e6815a67c6","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Our analysis demon- strated that existing SOTA CF detection models trained on prior benchmark datasets generalize poorly to elderly speech, reveal- ing a critical robustness gap","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:8ebe0f7f5510bddc11d13546411f375a406cb8ae55e33eebec78f6fe4c3d42fe","observation_id":"999b7e30-e3fb-414b-bf7c-34d6165452a0","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:9e0f7cfddcd63234b4cad77d037bd0bdac0b6dbc9a88b9a3725ad9490fc7d018","observation_id":"30bb91d0-e7a5-44f2-b512-a52a3ef45886","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"These tools did not contribute to the development of scientific concepts, data analysis, generation of results, or interpretation of findings","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:46ee851f24fcca4d8af600b816534f571e63488fe3b42ffdcc08fab2d6f8d450","observation_id":"b57a1441-439b-467a-ab0e-656a8a4f2497","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Asvspoof 2015: the first automatic speaker verification spoofing and countermeasures challenge,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:d7f8ce2f10b48971315c488fc224951cb9fea1b37dbe2012f756236b7cf0bb68","observation_id":"5a24325a-c002-4ed1-a0fb-c72edb225d01","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"The asvspoof 2017 challenge: As- sessing the limits of replay spoofing attack detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:b272165dd87b38c091e8f242f04bb10862b8b615e5674be20e0ff8d499001b33","observation_id":"cedef7fc-c444-42cb-92e4-16b1763d54c3","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Asvspoof 2019: A large-scale public database of synthesized, converted and replayed speech,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:c55390ac4516835a0d15df085450f1c0d7b7102b76214fed5c655aac6cc6e8f2","observation_id":"3313f703-a790-4a88-a1f8-f33e663b09e2","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Asvspoof 2021: Towards spoofed and deepfake speech detection in the wild,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:6e6802f37c2fd6eb142e4edd89b177bc6e21c41aff8ab386aacfc6d18afb7b6c","observation_id":"61ad13c8-3ad2-40af-a8e0-a35fe1af88c0","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08739","last_updated":"2024-08-16T13:37:20Z","snapshot_observed_at":"2026-07-06T19:01:32.237848Z","submitted_at":"2024-08-16T13:37:20Z","title":"ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale","version":1},"cited_work":{"arxiv_id":"2408.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.08739","snapshot_observed_at":"2026-07-04T07:49:38.746872Z","title":"ASVspoof 5: Crowdsourced speech data at scale","venue":null,"work_id":"00f9ada8-7f80-449e-95d3-b9f58bfad87a","year":2024},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"cited_paper":"/paper/2408.08739","citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:2c98395894452b7ec482dba482d24fc461488c232b436f669cc52c66f4f92929","observation_id":"9847a52b-920e-40f5-a295-971ed6df9d13","resolution":{"observed_at":"2026-07-04T07:49:38.748690Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Combining evidences from mel cep- stral, cochlear filter cepstral and instantaneous frequency features for detection of natural vs. spoofed speech","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:6181584d1de79284c2331623afbb147e8c10dd1fa8deb5045daf76757fb781bf","observation_id":"92182eb8-0a36-458f-a3e2-90470fc4ad3b","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Cochlear filter and instantaneous frequency based features for spoofed speech detection,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:c4148df9ba62ee725937eaac9617b520adc8d980cf2db270e105b4707d0e1dde","observation_id":"7cd04638-042f-4329-be3a-e42b47a5b3a8","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Toward robust audio spoofing detection: A detailed comparison of traditional and learned features,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:8965b7f100410812dfa23e379383b2e5de4a820ab19be58fb50a31d797cfee6d","observation_id":"bcf1761c-18ae-431b-8058-89c2818fb6eb","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Spoofing speech detection using temporal convolutional neural network,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:85d53fcfaf08c5a9ac5719be2bca82b9f29cea1990703ecc2f8892faf4f8632c","observation_id":"ce452a1e-9596-4d4e-aed0-56d491e521b8","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"A light convolutional gru-rnn deep feature extractor for asv spoofing detection,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:cac6133fcc60699c13db2a6656c0161ccb588b5eaa80df4dbc7365a145b06797","observation_id":"17226add-10d2-4151-9956-ceb4587ddbad","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Aasist: Audio anti-spoofing using integrated spectro-temporal graph attention networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:ad26f18d37128e62532cd95528e1706a5a95f09473f1f10653a5ff93d0c1b107","observation_id":"89eb3a2a-796d-4f43-9989-340f182ac4cc","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"The vicomtech audio deep- fake detection system based on wav2vec2 for the 2022 add chal- lenge,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:d5244d586f5c2d80820f4995925f6e9d0de285e33c818fd0885ebc872e25d762","observation_id":"4db8b040-e064-4ca3-908f-256311ddf152","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Automatic speaker verification spoofing and deep- fake detection using wav2vec 2.0 and data augmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:3d86ed1926be9859038c693c6253e307e07041c545d6ec2ec02c67f1f91bb66a","observation_id":"071f1807-5fbd-4dc1-b3f3-fdbfd228534b","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Im- proved DeepFake Detection Using Whisper Features,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:d4b169b6315499bcec930b0423c99e7b8f07a678e4a749529b46cf1167d22407","observation_id":"b7d2c7c4-4819-469d-ae88-a209dbff4714","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Audio deep- fake detection with self-supervised wavlm and multi-fusion atten- tive classifier,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:f00ede08e6a7079074a4ad5110fc28319d6f51859f356644980105a48366e49c","observation_id":"147d7257-dde8-4495-b0fc-a80a3ac48dc1","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Efficient audio deepfake detection using wavlm with early exiting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:fc043393d50f24dc6ae7caad28a8d127d6e727f7645436206aec44595c0cd5c6","observation_id":"5eacaa13-864b-468f-9ff8-747b129e9677","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Leveraging SSL Speech Features and Mamba for Enhanced DeepFake Detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:b15f66569f5921400999c67357000843cc9dc768d079239800d30f9aa97825af","observation_id":"de84260f-ae57-4482-b4c8-d608a6e15884","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Multi-level ssl feature gating for audio deepfake de- tection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:688a0dac87144da9d17d6527b93925699801ef6cf81d2bf7f00d09633f491159","observation_id":"bb1ff3b6-5d7a-463a-bb7d-06bf34f8217f","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Audiolm: a language modeling approach to audio gener- ation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:fb2b0f7975f3c917a9980be39c276ef2e9f9c461c70a602b086e388823fa2624","observation_id":"cdeef671-e2d4-4828-b3aa-c87f9a0c5624","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Codecfake: Enhancing anti- spoofing models against deepfake audios from codec-based speech synthesis systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:76ac3f25bea00b2a58316e108337fdb7e6e1d5537a62f1ff5ec58053971577ed","observation_id":"59bef89c-4903-472c-aadd-84baa3228963","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Codecfake: An initial dataset for detecting llm-based deepfake audio,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:78f00cb921e0bc0f052ee1d25c2ae19430adacd250a93b5d45dafbbe456ee5f6","observation_id":"12b40220-d560-46a2-a151-1c8d414b3bf7","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08238","last_updated":"2026-06-05T17:32:46Z","snapshot_observed_at":"2026-07-06T20:21:00.314703Z","submitted_at":"2025-01-14T16:26:14Z","title":"CodecFake+: Codec-Based Resynthesized Data as a Proxy for Detecting CodecFake Speech","version":3},"cited_work":{"arxiv_id":"2501.08238","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.08238","snapshot_observed_at":"2026-07-04T07:49:38.750008Z","title":"CodecFake-Omni: A large-scale codec-based deepfake speech dataset","venue":"cs.SD","work_id":"da148f0e-02bf-4b02-a1d3-d611d870a9ae","year":2025},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"cited_paper":"/paper/2501.08238","citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:b35a7c7839acc9ba7f4b9817dfffda7397891439d4a583d44fed3ea36d8862ed","observation_id":"8c9a885c-8172-4f02-bfab-83c651006246","resolution":{"observed_at":"2026-07-04T07:49:38.751699Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Whiadd: Semantic- acoustic fusion for robust audio deepfake detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:6cec4bea6e5be66b93394dafb74b2a994e75ecf7b4012ab70df77ea1ce0a1470","observation_id":"41830243-bdc5-4d0f-9330-f6a1f338c55b","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"The codecfake dataset and countermea- sures for the universally detection of deepfake audio,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:7cfc4685b85711495d698c50b29318b560f92de587b583ac64c7d022be31338a","observation_id":"e3b4db88-81e2-4425-8ec6-a52d1ff65ebd","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"How does our voice change as we age? a systematic review and meta-analysis of acoustic and perceptual voice data from healthy adults over 50 years of age,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:034a3036d2e9331ece2795515a3d00c4d096c872e23a8db3f7197f0c3cfb727c","observation_id":"9edcbc64-a219-45da-908d-92bf40cce833","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"The INTERSPEECH 2020 Computational Paralinguistics Challenge: Elderly Emotion, Breathing & Masks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:6ad3e94292978f1ff57a9b8823325f710cc63d6951b0b6bb2d88f29e30837277","observation_id":"a5dbfcfd-65e8-49ed-b138-0e4dbdb325d5","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Is Everything Fine, Grandma? Acous- tic and Linguistic Modeling for Robust Elderly Speech Emotion Recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:78f1038fa1800a1f249ad34998b228d6510f2ec181d5db6d0d1b750b07ee6e35","observation_id":"81c9d6bd-a681-4607-a95a-3330af67e9ee","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Human voices communicating trustworthy intent: A demographically di- verse speech audio dataset,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:b64856a738f135f26de65bce140216d6b3f5e83ae8ddf25503f82e96c4e8afcb","observation_id":"d4c565ac-2116-4d07-bf78-21bc45e23f9b","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Strong alone, stronger together: Synergizing modality-binding foundation models with optimal transport for non-verbal emotion recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:b6881b9080645a1b9c0414ac91f8960b2f97dd623da03f7acfe82871b765b0b6","observation_id":"448cdda6-870d-458c-8c33-494e340ae8de","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00809","last_updated":"2024-03-31T21:48:50Z","snapshot_observed_at":"2026-07-06T17:53:48.072712Z","submitted_at":"2024-03-31T21:48:50Z","title":"Heterogeneity over Homogeneity: Investigating Multilingual Speech Pre-Trained Models for Detecting Audio Deepfake","version":1},"cited_work":{"arxiv_id":"2404.00809","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.00809","snapshot_observed_at":"2026-07-04T07:49:38.743892Z","title":"arXiv preprint arXiv:2404.00809 , year=","venue":null,"work_id":"44cf5523-3a85-47e5-832e-766640bbb41a","year":2024},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"cited_paper":"/paper/2404.00809","citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:e45e3b5ee0e660ba01f2f0ae5f269ca32cac69694ba2a7201d8f4dbdc031019a","observation_id":"a0500391-ede5-4357-9ddb-9838c29e9894","resolution":{"observed_at":"2026-07-04T07:49:38.745609Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Seniortalk: A chinese conversation dataset with rich annotations for super-aged seniors,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:61c958c358a467cdb7c484f7293f99ae0175e1f3b3294e32068bd916d8b61614","observation_id":"a3aa4004-41d8-42f2-baf5-6589360dc5c2","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:a62cc3e5f8ae117ee3d35a75571484d25991479c24b9b39a4f32aeedc99be016","observation_id":"02e6bedb-d840-4965-b970-387776f9a0ad","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-03T16:47:47.192907Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":"2210.13438","doi":"10.48550/arxiv.2210.13438","metadata_source":"pith","pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"High Fidelity Neural Audio Compression","venue":"eess.AS","work_id":"bc645d2d-e9f2-4cb8-9a6d-bd557bc7a258","year":2022},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:218583ef5cab58bafb8b9da108478d9e464b2010221bf026f177f3d5aef93c4c","observation_id":"6dd1b091-614c-4be4-b425-c0f15ed77a02","resolution":{"observed_at":"2026-07-04T07:49:38.750545Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-19T16:22:25.658509+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-19T16:22:25.658509+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Soundstream: An end-to-end neural audio codec,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:812a82ef7516c9abaf8532f00722d6ad77f90e17983de08685e930bc511b91b0","observation_id":"5f0fa063-a086-4c6c-8716-9ceba1afcb5d","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Speechtokenizer: Unified speech tokenizer for speech language models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:b9c1a64bfee403e45268ea3ca8cf1a3b4002da365b4aa328b89f290207b91cca","observation_id":"2db8fb41-3b0f-4d3c-9f36-ff87773bcae3","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Available: https://openreview.net/forum?id= AF9Q8Vip84","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:3891fd160d3088eec38c0230611e78fae3fefac720d93e2638a237b834187f6b","observation_id":"a4d6aae2-80c8-41eb-9eab-8362ee4f2086","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Funcodec: A fundamental, reproducible and integrable open-source toolkit for neural speech codec,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:bf38200b549882cf9e4254d7bb9e639d51ad896156ae21a9eea520748e9b8010","observation_id":"e34e3f2a-cb66-414c-8eed-e287e0cedc04","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Audiodec: An open-source streaming high-fidelity neural audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:7f7c1fd1cbe9676f1f990ba16aeb8ecea80912d1bed3d1d09ed69ef17de343f0","observation_id":"816b40cd-1662-41b5-953d-ac223e421c8f","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Snac: Multi- scale neural audio codec,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:57481133831e1ab9937368c588752bdeac56f8503440381a81d56e8815569427","observation_id":"05b9488b-34bb-4046-95b4-7c4600cdce1e","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":"2410.00037","doi":"10.1121/1.1906946","metadata_source":"pith","pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moshi: a speech-text foundation model for real-time dialogue","venue":"eess.AS","work_id":"3104332b-d279-44c8-aaa7-3d5a13c01832","year":2024},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:b135044edfa88e43c0c2a0bf0fd321b3cfb5aa71bccb0904dae0acb92b8cbcdb","observation_id":"1be39b2e-5c25-43db-922a-eaddfb01c3f0","resolution":{"observed_at":"2026-07-04T07:49:38.744736Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Languagebind: Extending video- language pretraining to n-modality by language-based semantic alignment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:d7909c2f72063a14883d64eae2729d394a466ee181613a8d83fea7d9e3a4f040","observation_id":"54aa2c9d-469b-45e3-9de1-819945994f32","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Imagebind: One embedding space to bind them all,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:760b02f181993d7e08a6234ff75db3a084fee8b73e27ccbe51c1fea017fbf3c1","observation_id":"ecf71233-1aef-44dc-9dee-35e5c97acc67","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:31d9ff997ae1652035025f5232905541f4f29eef48af1250f81bf3ea5de40c1e","observation_id":"1aa5cefb-4513-41a1-8774-a935672e337a","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:5471ed1d84be56055fb2ca760f29e072b7ccd38f88bbfef943d540b1caca3c96","observation_id":"2d4ea284-ca64-4fc6-a7f6-3703936e47bb","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:6bcac2f05b58b7b11bff420af4f7a4ea7da85d241bc396c757d8be29c426866e","observation_id":"e5181499-a6f2-4548-98e5-9910c32b8555","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.01563","last_updated":"2018-06-05T08:59:45Z","snapshot_observed_at":"2026-07-06T06:43:01.789337Z","submitted_at":"2018-06-05T08:59:45Z","title":"Multi-sensor data fusion based on a generalised belief divergence measure","version":1},"cited_work":{"arxiv_id":"1806.01563","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.01563","snapshot_observed_at":"2026-07-04T07:49:38.752877Z","title":"Multi-sensor data fusion based on a generalised belief divergence measure","venue":"cs.AI","work_id":"077b5d96-6a6a-4873-9bc7-3c0d9366c3e7","year":2018},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"cited_paper":"/paper/1806.01563","citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:c49d556004d28d89d8fce7966a24da11d24429a278482fc5927bc954fa460fdc","observation_id":"2d889acf-3367-4770-bf35-2b5c8959e2a6","resolution":{"observed_at":"2026-07-04T07:49:38.754369Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:51:14.919171Z","title":"Multimodal generative learn- ing utilizing jensen-shannon-divergence,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-26T12:51:14.919171Z"},"links":{"citing_paper":"/paper/2606.21735"},"observation_digest":"sha256:15c710bd585dc506329cf8728728a7506154536c7e7a2342282fd446b3e51f83","observation_id":"552901eb-39ab-4dee-a09d-fad269e4013a","resolution":{"observed_at":"2026-06-26T12:51:14.919171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.21735","last_updated":"2026-06-19T20:45:55Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-07-06T23:56:40.795364Z","submitted_at":"2026-06-19T20:45:55Z","title":"Bridging the Age Gap: Towards Detecting Neural Audio Codec Synthesized Elderly Speech Deepfake"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":47,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2606.21735."}