{"as_of":"2026-08-24T01:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f9de5eb57e7376f5525a95319bb0356e3a314f2c1aa69ef82922d30a473032e3","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T01:12:30.727993Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.14753/citation-record","integrity":"/paper/2607.14753/integrity","json":"/paper/2607.14753/citation-record.json","paper":"/paper/2607.14753"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.04904","last_updated":"2024-06-07T12:56:11Z","snapshot_observed_at":"2026-08-19T22:45:01.557030Z","submitted_at":"2024-06-07T12:56:11Z","title":"XTTS: a Massively Multilingual Zero-Shot Text-to-Speech Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04904","snapshot_observed_at":"2026-08-02T01:12:29.763464Z","title":"Xtts: a massively multilin- gual zero-shot text-to-speech model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:29.763464Z"},"links":{"cited_paper":"/paper/2406.04904","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:5a113fb7824dcc84d451e15f72a18faf5dadff924cbd69db823da6990327da00","observation_id":"fd0d35ac-7503-41bd-bf97-9c3a0b5ea50a","resolution":{"observed_at":"2026-08-02T01:12:29.763464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17589","last_updated":"2025-05-27T07:48:34Z","snapshot_observed_at":"2026-08-16T06:12:24.457686Z","submitted_at":"2025-05-23T07:55:21Z","title":"CosyVoice 3: Towards In-the-wild Speech Generation via Scaling-up and Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17589","snapshot_observed_at":"2026-08-02T01:12:29.882137Z","title":"Cosyvoice 3: Towards in-the-wild speech generation via scaling-up and post-training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:29.882137Z"},"links":{"cited_paper":"/paper/2505.17589","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:3066cb36e7bf32febad553a62d08c4fb25f5d2c11ab9f3ae661b1ab9ad8918c3","observation_id":"a24dc379-60b3-44f3-a100-94f91d27ef32","resolution":{"observed_at":"2026-08-02T01:12:29.882137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13774","last_updated":"2023-05-23T07:42:52Z","snapshot_observed_at":"2026-08-20T03:00:07.655339Z","submitted_at":"2023-05-23T07:42:52Z","title":"ADD 2023: the Second Audio Deepfake Detection Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13774","snapshot_observed_at":"2026-08-02T01:12:30.062710Z","title":"Add 2023: the second audio deepfake detection challenge,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.062710Z"},"links":{"cited_paper":"/paper/2305.13774","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:a1074b209f327a9957738d077743c480e79da5b80bfe42a731047f38b5f5f057","observation_id":"340bb56e-a2b4-49eb-b90d-aef84886eeaa","resolution":{"observed_at":"2026-08-02T01:12:30.062710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08739","last_updated":"2024-08-16T13:37:20Z","snapshot_observed_at":"2026-08-19T02:11:16.717807Z","submitted_at":"2024-08-16T13:37:20Z","title":"ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08739","snapshot_observed_at":"2026-08-02T01:12:30.268649Z","title":"Asvspoof 5: Crowdsourced speech data, deepfakes, and adversarial attacks at scale,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.268649Z"},"links":{"cited_paper":"/paper/2408.08739","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:249be77efbbd67a7a2e5e5a6a5e4d6437a136a8b97ba7120c751160e1f7c5db2","observation_id":"81ba8b51-44b1-47a4-8e04-0c19f9265583","resolution":{"observed_at":"2026-08-02T01:12:30.268649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.476022Z","title":"Sasv 2022: The first spoofing-aware speaker verification challenge,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.476022Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:691d5a75bfce452d6bfc88dcf1b02dacc2d320402edda9e9dc78730772e48994","observation_id":"b3117174-f25a-4883-8ccd-b0b607f7cb0a","resolution":{"observed_at":"2026-08-02T01:12:30.476022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.603679Z","title":"Ecapa-tdnn: Em- phasized channel attention, propagation and aggregation in tdnn based speaker verification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.603679Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:6fad19c19deba9294a6691d2f5deae54441f378c98417db30402430c765a0e5e","observation_id":"503673a0-a803-4033-a617-094bb82064b4","resolution":{"observed_at":"2026-08-02T01:12:30.603679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.611183Z","title":"Baseline systems for the first spoofing-aware speaker verification challenge: Score and embedding fusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.611183Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:a63f1fb44c6852e4680a331e68b8a8ffec91d3170047a5247d7c881e69b17fff","observation_id":"f83ea075-9d4d-4da2-9dc0-d159ea2543c3","resolution":{"observed_at":"2026-08-02T01:12:30.611183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.613750Z","title":"Two methods for spoofing-aware speaker verification: Multi-layer perceptron score fusion model and integrated embedding projector,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.613750Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:3e1677ffdce5f1acda897442fb5fbdf280267d3a6d2b30e22a7bcdabd34b83a0","observation_id":"e6a78802-e628-4eb2-b6ca-010fa146dff3","resolution":{"observed_at":"2026-08-02T01:12:30.613750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.616095Z","title":"The dku-oppo system for the 2022 spoofing-aware speaker verification challenge,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.616095Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:09bf8cec96d68a126bb3ec21479e5339c4cb100ae7e667a72b24a28c9c19b278","observation_id":"85c17316-1536-443f-9fd3-486b44e3cc83","resolution":{"observed_at":"2026-08-02T01:12:30.616095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.618474Z","title":"Joint optimiza- tion of speaker and spoof detectors for spoofing-robust automatic speaker verification,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.618474Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:2a2e8d4b8b0db56ca2536ef216ab2c67fee5437f5ec0de7b826cd76a24dddc30","observation_id":"4cdea7df-61ba-4a10-b949-0df27a6077ca","resolution":{"observed_at":"2026-08-02T01:12:30.618474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.620887Z","title":"Integrated spoofing-robust automatic speaker verification via a three-class formulation and llr,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.620887Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:38e9b41578d39d3e1ffaf0eb6733159fec3bc55b2ad917c62d8a29b55cf84e08","observation_id":"8dfbd579-09b0-4499-affe-0d2c33f7df34","resolution":{"observed_at":"2026-08-02T01:12:30.620887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13289","last_updated":"2024-04-08T06:12:52Z","snapshot_observed_at":"2026-08-21T12:15:18.108504Z","submitted_at":"2023-10-20T05:41:57Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13289","snapshot_observed_at":"2026-08-02T01:12:30.623756Z","title":"Salmonn: Towards generic hearing abilities for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.623756Z"},"links":{"cited_paper":"/paper/2310.13289","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:05264aa953d55500a30c789870f00376f3a6e4f86f2df14f8fbffcd3efd660ec","observation_id":"e2347886-cba5-4c40-961b-d8c4571e5bf7","resolution":{"observed_at":"2026-08-02T01:12:30.623756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-02T01:12:30.626787Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.626787Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:b8b82995beaf889390b17d13fcc99d2f65ea379b0b455d1d98ca3ff192fba2d1","observation_id":"ab290f69-137b-46f3-95fc-7abc6466604c","resolution":{"observed_at":"2026-08-02T01:12:30.626787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13237","last_updated":"2025-08-24T16:09:17Z","snapshot_observed_at":"2026-08-21T23:18:20.561146Z","submitted_at":"2025-05-19T15:20:32Z","title":"SAKURA: On the Multi-hop Reasoning of Large Audio-Language Models Based on Speech and Audio Information","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13237","snapshot_observed_at":"2026-08-02T01:12:30.629444Z","title":"Sakura: On the multi-hop reasoning of large audio-language models based on speech and audio information,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.629444Z"},"links":{"cited_paper":"/paper/2505.13237","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:49ed0d4b8fa1f033753552b2b7a51ba6493488dffc240068f12b859d1f75a71c","observation_id":"3439d7d3-c933-4473-a804-f21bf2009162","resolution":{"observed_at":"2026-08-02T01:12:30.629444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.14664","last_updated":"2026-04-16T09:15:45Z","snapshot_observed_at":"2026-08-11T03:26:54.318112Z","submitted_at":"2025-10-16T13:19:07Z","title":"SpeechLLM-as-Judges: Towards General and Interpretable Speech Quality Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.14664","snapshot_observed_at":"2026-08-02T01:12:30.632007Z","title":"Speechllm-as-judges: Towards general and in- terpretable speech quality evaluation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.632007Z"},"links":{"cited_paper":"/paper/2510.14664","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:a038c0e174edd2fc7192e032e85eab3ce56a7b3a6256f6d4fe31e70c08620a68","observation_id":"99daa1d8-5eab-46f1-ad16-6d4f44605a00","resolution":{"observed_at":"2026-08-02T01:12:30.632007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.634475Z","title":"Holiantispoof: Audio llm for holistic speech anti-spoofing,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.634475Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:e83067fe4a6cbbc56988139fa1167c018450664176124a5a2de251fa512f04d6","observation_id":"d0dbf360-4b2a-426f-8376-a18b9ea65d93","resolution":{"observed_at":"2026-08-02T01:12:30.634475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.637609Z","title":"Audio language model for deepfake detection grounded in acoustic chain-of-thought,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.637609Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:90cf27590fe154fefc8b22389517848aad3954a9626a9a00af2212982f6556c3","observation_id":"30256248-73ba-4c6f-9180-74615ed14fc5","resolution":{"observed_at":"2026-08-02T01:12:30.637609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.639912Z","title":"Can audio large language models verify speaker identity?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.639912Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:a0d92a9f1e878b48c0fb7d50fb70eb4b97bc0c743bd97b5c3da2484ea52ff3ef","observation_id":"8bd4d293-8f28-40ec-9cea-111ff6476097","resolution":{"observed_at":"2026-08-02T01:12:30.639912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15044","last_updated":"2026-05-14T16:36:57Z","snapshot_observed_at":"2026-08-06T09:10:03.624671Z","submitted_at":"2026-05-14T16:36:57Z","title":"SpeakerLLM: A Speaker-Specialized Audio-LLM for Speaker Understanding and Verification Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15044","snapshot_observed_at":"2026-08-02T01:12:30.642774Z","title":"Speakerllm: A speaker-specialized audio-llm for speaker understanding and verification reasoning,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.642774Z"},"links":{"cited_paper":"/paper/2605.15044","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:6c56afb51fb2a8a2e27f9f709fd35da58c8445178f2435ae58df63d396def236","observation_id":"d81099a3-acd7-40a9-8e4f-0fd192d97208","resolution":{"observed_at":"2026-08-02T01:12:30.642774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.644936Z","title":"Wildspoof: advancing in-the-wild data in text-to-speech generation and spoofing- aware automatic speaker verification,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.644936Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:5eba5b0d1b16a74f5f896d1babee9d0594c2fd6fc30125eb1dd26e1e73a180ac","observation_id":"0fbca31f-552c-4486-97af-71dc116cc69d","resolution":{"observed_at":"2026-08-02T01:12:30.644936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08184","last_updated":"2026-04-09T12:38:19Z","snapshot_observed_at":"2026-08-11T19:46:32.838226Z","submitted_at":"2026-04-09T12:38:19Z","title":"AT-ADD: All-Type Audio Deepfake Detection Challenge Evaluation Plan","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08184","snapshot_observed_at":"2026-08-02T01:12:30.647757Z","title":"At-add: All-type audio deepfake detection challenge evaluation plan,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.647757Z"},"links":{"cited_paper":"/paper/2604.08184","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:c3024a5dc470764b2908417bfd8472735da322430a8928b2ff4720cc1e098fec","observation_id":"a84be2bd-68c5-45d6-98b6-e3b3dbdc2ccc","resolution":{"observed_at":"2026-08-02T01:12:30.647757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.09568","last_updated":"2026-05-25T00:50:21Z","snapshot_observed_at":"2026-08-15T07:50:56.634385Z","submitted_at":"2026-05-10T14:29:35Z","title":"RADAR Challenge 2026: Robust Audio Deepfake Recognition under Media Transformations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.09568","snapshot_observed_at":"2026-08-02T01:12:30.650313Z","title":"Radar challenge 2026: Robust audio deepfake recognition under media trans- formations,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.650313Z"},"links":{"cited_paper":"/paper/2605.09568","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:e629df620dc450fe0c2bcd751a16361cb7d2d44390a84845f8fc4bc2e9e8ee11","observation_id":"2c090d5e-3646-4d49-93de-06f00e767fcb","resolution":{"observed_at":"2026-08-02T01:12:30.650313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.10791","last_updated":"2026-06-26T07:49:38Z","snapshot_observed_at":"2026-08-17T02:51:06.941934Z","submitted_at":"2026-06-09T12:42:14Z","title":"Overview of ESDD2: Environment-Aware Speech and Sound Deepfake Detection Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.10791","snapshot_observed_at":"2026-08-02T01:12:30.652884Z","title":"Overview of esdd2: Environment-aware speech and sound deepfake detection challenge,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.652884Z"},"links":{"cited_paper":"/paper/2606.10791","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:d0cf777fd551cb0e58ee872c86eeb9a58abf212d32852e76cd15798c9902734a","observation_id":"d1286339-70b2-46c1-99ef-d8ef0b441fa1","resolution":{"observed_at":"2026-08-02T01:12:30.652884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.655599Z","title":"Aasist: Audio anti-spoofing using integrated spectro-temporal graph attention networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.655599Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:54ac96de24f98e30582fb6de3275ace5320c98476c5d99dc766fdf600418d303","observation_id":"9aacfaf8-dbe0-4252-a69c-bfd8ecb1c775","resolution":{"observed_at":"2026-08-02T01:12:30.655599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.657689Z","title":"Rawboost: A raw data boosting and augmentation method applied to automatic speaker verification anti-spoofing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.657689Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:2ae581d070a392ad09b5c69339d0cbed7cec8eedd6a5b484b06e8f861f35c155","observation_id":"1ae3caa8-1d46-4284-a58e-828c8f7cbee2","resolution":{"observed_at":"2026-08-02T01:12:30.657689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.660663Z","title":"Samo: Speaker attractor multi-center one-class learning for voice anti-spoofing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.660663Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:741efd2a53176742b27db2c9b06a0d53ad9cd5c4853e5666a4dc556dfe7a4321","observation_id":"0b628a8c-df07-4cff-8078-2fd7767f9c6d","resolution":{"observed_at":"2026-08-02T01:12:30.660663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.663145Z","title":"End-to-end anti-spoofing with rawnet2,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.663145Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:5655509efedda744f2a02f136ced829e14af6edd4f64075d499df876746b51ae","observation_id":"1d315113-6af7-4f07-8f5d-bf1dd4d42447","resolution":{"observed_at":"2026-08-02T01:12:30.663145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12233","last_updated":"2022-02-28T11:50:57Z","snapshot_observed_at":"2026-08-16T17:18:51.871221Z","submitted_at":"2022-02-24T17:55:00Z","title":"Automatic speaker verification spoofing and deepfake detection using wav2vec 2.0 and data augmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12233","snapshot_observed_at":"2026-08-02T01:12:30.665317Z","title":"Automatic speaker verification spoofing and deepfake detection using wav2vec 2.0 and data augmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.665317Z"},"links":{"cited_paper":"/paper/2202.12233","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:b29d5aeaf5bf680df73facc7dfa8c49c19aabd64059461c25f529b03ab987fc2","observation_id":"7f383198-3aa8-4dcf-9328-7004a51c9654","resolution":{"observed_at":"2026-08-02T01:12:30.665317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00251","last_updated":"2026-04-30T21:32:40Z","snapshot_observed_at":"2026-08-14T05:00:21.860788Z","submitted_at":"2026-04-30T21:32:40Z","title":"Alethia: A Foundational Encoder for Voice Deepfakes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.00251","snapshot_observed_at":"2026-08-02T01:12:30.668116Z","title":"Alethia: A foun- dational encoder for voice deepfakes,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.668116Z"},"links":{"cited_paper":"/paper/2605.00251","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:1859d7497fd52f6f9463868eb643831ea0c8ccf5a6938ebf7b90ee24d186a7e2","observation_id":"31613142-6035-4ac0-af9c-3f340d2897df","resolution":{"observed_at":"2026-08-02T01:12:30.668116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.670300Z","title":"A subnetwork approach for spoofing aware speaker verification,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.670300Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:872bfdcde80580e59c43cc7c6193f10b5cd2e64c209c41e6467f61e8bdf4a684","observation_id":"bb392e0e-f229-4cd4-bf10-5702baf45e09","resolution":{"observed_at":"2026-08-02T01:12:30.670300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.673008Z","title":"Spoofing- aware speaker verification robust against domain and channel mis- matches,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.673008Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:7105cb547887a8c4beafca746978a8a74ea4f24ce2b85b620d59178be975b317","observation_id":"e6f3fce6-8c41-45ba-98b6-650950a504ae","resolution":{"observed_at":"2026-08-02T01:12:30.673008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.675768Z","title":"Spoofceleb: Speech deepfake detection and sasv in the wild,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.675768Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:c8b0ac111d54d1c7b0370a1d9ce6cc6d2e191d3f0d039ffcd4141148a6394f9c","observation_id":"fffd7f2d-6453-4e39-992d-caa1393933e4","resolution":{"observed_at":"2026-08-02T01:12:30.675768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.678024Z","title":"But systems for wildspoof challenge: Sasv in the wild,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.678024Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:ced3229be083eae30c61ab7571f52044a875211dc42c82934563093521cb3624","observation_id":"aa0f9c6a-e4be-4fc2-9d32-3e02e2085275","resolution":{"observed_at":"2026-08-02T01:12:30.678024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.680922Z","title":"Wavlm: Large-scale self-supervised pre- training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.680922Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:283b11785c40914194ce2aa0ef0bd65e1f041fd873332821520c603c12bd3e2d","observation_id":"08315d76-f6d5-4874-b318-79d00ff19ea4","resolution":{"observed_at":"2026-08-02T01:12:30.680922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06992","last_updated":"2024-06-13T04:38:02Z","snapshot_observed_at":"2026-08-16T13:44:18.074840Z","submitted_at":"2024-06-11T06:44:54Z","title":"Scaling up masked audio encoder learning for general audio classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06992","snapshot_observed_at":"2026-08-02T01:12:30.683133Z","title":"Scaling up masked audio encoder learning for general audio classification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.683133Z"},"links":{"cited_paper":"/paper/2406.06992","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:248aa51951633c4fefc580bd2ee55fdf31cc50c3f21b69a9dccfe41142b0b224","observation_id":"3b53fdf3-0866-4d73-9c63-9cb55f6c3304","resolution":{"observed_at":"2026-08-02T01:12:30.683133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.685353Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.685353Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:e9b80e09463f44ef25667722b6e25aec0d3cf39c9d588fdb47b40f5d0916f820","observation_id":"b2081070-baef-47ac-92ef-b71df5489827","resolution":{"observed_at":"2026-08-02T01:12:30.685353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.687740Z","title":"Qformer: An efficient quaternion transformer for image denoising","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.687740Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:77be781f1f725d0f6eabbe3bfd79268d9f229e78b2439aa82fba7291cf0a9a93","observation_id":"a00dbd79-cb52-418f-a69c-39280524f576","resolution":{"observed_at":"2026-08-02T01:12:30.687740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-02T01:12:30.689733Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.689733Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:37364cf7ecb9e09032082fc38f2ee80aeb8bd0df0d0dbb6d044244ee375477e1","observation_id":"cad16e7c-042b-4bf4-9062-d0a1a834bf36","resolution":{"observed_at":"2026-08-02T01:12:30.689733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.692538Z","title":"Allm4add: Unlocking the capabilities of audio large language models for audio deepfake detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.692538Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:d29640edd3f982fc0d8946cb78e5ab5adc5e3a92a5ff02c5ecae5c47a0175d73","observation_id":"fe69f248-0c00-47be-b85b-899dcfd3eaac","resolution":{"observed_at":"2026-08-02T01:12:30.692538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.695093Z","title":"SALMONN: Towards generic hearing abilities for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.695093Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:6f1d144387fd69554efb079412f1b3a5f76a5f47ce7a62bc2c2ddb0cf60cfb04","observation_id":"38b592e5-853a-4f77-81e4-0bba071623ae","resolution":{"observed_at":"2026-08-02T01:12:30.695093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-08-14T01:27:16.843576Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-02T01:12:30.697035Z","title":"Qwen2-audio technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.697035Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:b7b47b5fdf2a6afb25ddc20ab8d7450487b3845e90e145423f904191acd29089","observation_id":"1c33a8f5-f9ba-4776-abcd-3c835d8373c2","resolution":{"observed_at":"2026-08-02T01:12:30.697035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.699701Z","title":"ArcFace: Additive angular margin loss for deep face recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.699701Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:e97a04dc04130fe44f750e2efd61dda4c21bee840b699310357cccbd245a4787","observation_id":"d5a037e2-3776-4128-a023-df801068bed7","resolution":{"observed_at":"2026-08-02T01:12:30.699701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.10725","last_updated":"2026-07-13T14:02:02Z","snapshot_observed_at":"2026-08-18T11:42:34.525229Z","submitted_at":"2026-03-11T12:59:12Z","title":"Towards Robust Speech Deepfake Detection via Human-Inspired Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.10725","snapshot_observed_at":"2026-08-02T01:12:30.702057Z","title":"Towards robust speech deepfake detection via human-inspired reasoning,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.702057Z"},"links":{"cited_paper":"/paper/2603.10725","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:f2c7105111c9b3d5ba1f71250ffc774057bdf138414ffb15fb37acc279b15fb0","observation_id":"99cead69-8327-44e7-953d-7767b5745f69","resolution":{"observed_at":"2026-08-02T01:12:30.702057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09375","last_updated":"2025-08-23T19:55:31Z","snapshot_observed_at":"2026-08-18T17:11:38.172533Z","submitted_at":"2025-06-11T03:50:16Z","title":"CoLMbo: Speaker Language Model for Descriptive Profiling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09375","snapshot_observed_at":"2026-08-02T01:12:30.704449Z","title":"Colmbo: Speaker language model for descriptive profiling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.704449Z"},"links":{"cited_paper":"/paper/2506.09375","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:26dddf6fc34595d5f2cc61d845e0044ac57a86d1d38e05abbb7fab6459ede015","observation_id":"00bc2fc1-edc9-4bd5-87d5-2f6625cd7dfb","resolution":{"observed_at":"2026-08-02T01:12:30.704449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.707184Z","title":"emotion2vec: Self-supervised pre-training for speech emotion repre- sentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.707184Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:ee143f365b62051f7d0250114b3656dbc3c3d14723109ebe9277bdfee2f32081","observation_id":"e4aa23fe-a131-45d3-83a1-ed34e2038f74","resolution":{"observed_at":"2026-08-02T01:12:30.707184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.709820Z","title":"Introducing Parselmouth: A Python interface to Praat,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.709820Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:982d82addc983ab5f01327f4bdae6fc59cbbe269619fe58aba0a6d2ce6bbc10d","observation_id":"4b3bdcd7-8658-48dc-bb7d-948979b91054","resolution":{"observed_at":"2026-08-02T01:12:30.709820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T01:12:30.712460Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.712460Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:b4547d0c76acdb761de62f1465efd8a264f66113fb5c63990bef4a7e97d23d0b","observation_id":"eb88e640-e3d7-4119-97ba-bf1716d81f0a","resolution":{"observed_at":"2026-08-02T01:12:30.712460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.714745Z","title":"V oxceleb: Large- scale speaker verification in the wild,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.714745Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:8d20503c7c36cc958dbf13f2947090281b2999f55d2bd7945ace8bd26f808790","observation_id":"5d34fea4-c69d-477c-8584-5a485b06abcd","resolution":{"observed_at":"2026-08-02T01:12:30.714745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.717077Z","title":"Step-audio-r1 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.717077Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:e7d0f0c8441972fae8e1e21681b919a64b00e8089d9171ab2437851a0e46a6c0","observation_id":"3cf4c6c5-7443-42ed-ad42-94996f90fea7","resolution":{"observed_at":"2026-08-02T01:12:30.717077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.719939Z","title":"Intema system description for the ASVspoof5 Challenge: power weighted score fusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.719939Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:d48907fe63cc591fc14cd949682d20dad09e41a00d2ee5376af247b25344dbdf","observation_id":"1d36fd5b-c891-4fec-816f-9e75c5eabb1b","resolution":{"observed_at":"2026-08-02T01:12:30.719939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01355","last_updated":"2025-04-15T18:00:05Z","snapshot_observed_at":"2026-08-21T22:09:11.002775Z","submitted_at":"2024-03-03T00:58:27Z","title":"a-DCF: an architecture agnostic metric with application to spoofing-robust speaker verification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01355","snapshot_observed_at":"2026-08-02T01:12:30.722446Z","title":"a-dcf: an architecture agnostic metric with application to spoofing-robust speaker verification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.722446Z"},"links":{"cited_paper":"/paper/2403.01355","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:18803f8d3b2bb430b484e00ad439db81a901f7a624353e2eeb25fe5c13f19fff","observation_id":"c58180b5-f691-45e4-81e3-daaf4ae0ea3f","resolution":{"observed_at":"2026-08-02T01:12:30.722446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:12:30.725372Z","title":"Ecapa2: A hybrid neural network architecture and training strategy for robust speaker embeddings,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.725372Z"},"links":{"citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:4099c362cfbdeb9b523a24089ea0f7ec6f13922c8832bd4820e2be17b6b99a11","observation_id":"0c853cf8-9369-4c3c-ab9b-c6ce120defa5","resolution":{"observed_at":"2026-08-02T01:12:30.725372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03615","last_updated":"2026-05-31T06:28:59Z","snapshot_observed_at":"2026-08-17T04:19:32.199418Z","submitted_at":"2026-01-07T05:46:45Z","title":"SARA: Stress Test Reasoning in Audio Deepfake Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03615","snapshot_observed_at":"2026-08-02T01:12:30.727993Z","title":"Analyzing reasoning shifts in audio deepfake detection under adversarial attacks: The reasoning tax versus shield bifurcation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T01:12:30.727993Z"},"links":{"cited_paper":"/paper/2601.03615","citing_paper":"/paper/2607.14753"},"observation_digest":"sha256:72516d1c7bda11ba54a6c383e03e7603c2826cfa97da1bea87dc27d8f8dec19a","observation_id":"36f50b24-5d1b-443d-9918-7ace1e01f2ee","resolution":{"observed_at":"2026-08-02T01:12:30.727993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.14753","last_updated":"2026-07-16T09:38:45Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-14T02:41:14.466076Z","submitted_at":"2026-07-16T09:38:45Z","title":"Large Audio Language Models for Spoofing-Aware Speaker Verification"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2607.14753."}