{"as_of":"2026-08-18T17:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1451c211b047c492e364a00e386f8ee916a3232e1bcd90631406a6d0367b9594","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T03:43:46.836705Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T03:43:46.836705Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.11706","snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"This need is growing as voice becomes a biometric and a con- trol channel for speech-driven agents and assistive technolo- gies","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"cited_paper":"/paper/2607.11706","citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:069b901d02d333b1452d5818779533ff628d5e4c2d2c63bfebe3fe1ecb0a2d1a","observation_id":"20359651-a61f-4c2f-8e27-174599020ebe","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.11706/citation-record","integrity":"/paper/2607.11706/integrity","json":"/paper/2607.11706/citation-record.json","paper":"/paper/2607.11706"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.11706","snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"This need is growing as voice becomes a biometric and a con- trol channel for speech-driven agents and assistive technolo- gies","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"cited_paper":"/paper/2607.11706","citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:069b901d02d333b1452d5818779533ff628d5e4c2d2c63bfebe3fe1ecb0a2d1a","observation_id":"20359651-a61f-4c2f-8e27-174599020ebe","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"As shown in Table 1, V oxENES includes 3,028 real speech sam- ples and 50,600 synthetic samples (original synthetic 4,600 and augmented synthetic 46,000)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:10b5a76d02aca4f7a88e2fd93f60dfbb09d4a0726ad8709e79cb956ec3b0e33f","observation_id":"ef461379-4929-4d6d-9886-1595afd6e920","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:a342f3318f77fdb87449a333475d91953ca15923268f09d223f9b0dd9df0bbca","observation_id":"c571bb25-d7d7-4c9f-b28d-cc139a65e07f","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:f6f98193ebb3b8d5d50df6e0d53795fc791c02f88d6ceb10e35cb91f11f29283","observation_id":"a794a995-243e-4adc-a0cb-25247bbdb057","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:3d419ade3006a56ac9fad57438a6d66b98a47a5c688caff8f9993d698d5d0e03","observation_id":"bf82098c-7a10-43ef-943d-2acd58015e53","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"All authors reviewed, verified, and take full responsibility for the content, experiments, and conclusions presented in this paper","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:0700a2163d2cbdd8d492eb79eae3a04490ea9f6c76a990f60b059f97d521bd9d","observation_id":"ccec32f4-e596-42c9-b62a-34b281813fdd","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"Clearmask: Noise-free and naturalness-preserving protection against voice deepfake attacks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:939d8d3b51fb77d945cbf89edde20ab6d01d1ab0fe8a39f65bb153871d8719cb","observation_id":"852df5a5-21ff-4d09-adcc-94042ff15629","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"Wavepurifier: Purifying audio adversarial exam- ples via hierarchical diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:b6903573ca8d9d6f45b7f4ad0deef373533cfbb4608986a77177ef368c629c44","observation_id":"6e195bd2-de9b-4a63-9dba-1ba17834e417","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"Phan- tomsound: Black-box, query-efficient audio adversarial attack via split-second phoneme injection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:73ad2964d73a77c7624c0bbfd1a3a99f01cbdbdaef6f852ba18be8279ab47230","observation_id":"8d13c2de-00e8-45d8-8282-00f0ccf9a66c","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"Vsmask: De- fending against voice synthesis attack via real-time predictive per- turbation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:81d54354eaba86f7295e581048dc3058ce8e4d29bd3c3201c10986a03937ce50","observation_id":"68e9d7b4-984e-446c-ad4e-92e4656909e9","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"ASVspoof 2019: Future horizons in spoofed and fake audio de- tection,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:51a797223060627bae8eb78b74173bc4056cc8602cc30865de6276a6995df5ec","observation_id":"d6079db1-bbee-4507-98f2-bf26421ddced","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"ASVspoof 2021: accelerating progress in spoofed and deepfake speech detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:b0f5115f0d3de64f50591d5b306f2bb991dee99c07fdbf20c0ca3734e6925717","observation_id":"42ef3b69-3c8a-4627-8986-c370794416b2","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"ASVspoof 5: Design, collection and val- idation of resources for spoofing, deepfake, and adversarial attack detection using crowdsourced speech,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:0fb8eb55ca73cbafab3e8b4d0a2f8a413985b18774132595c7daf8127fa0ce8d","observation_id":"a9b2bbba-1f9b-44cc-8ad9-ef4335ccc64d","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"WaveFake: A data set to facilitate audio deepfake detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:87bd690fb64fdb5f9ccec156fc92fc49506e3e02c33d976ab34c90401469db7a","observation_id":"a91792f2-93f1-4085-b3a2-e85dea72bd44","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"Does audio deepfake detection generalize?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:09f24b9c85e2dfbb7afa5040f98e8e5d433be29d8c792f3b3bfb4a1f9c94738d","observation_id":"c5835348-1ad7-46d8-95ed-e54a22314b57","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"MLAAD: The multi-language audio anti-spoofing dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:f30905d5719bbe57bc9308adb71e5142e43d4592e5b0de60187d234cab357461","observation_id":"2a8cd8fc-a2ae-42a5-9643-1090b217b892","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06348","last_updated":"2024-09-10T09:07:12Z","snapshot_observed_at":"2026-08-16T13:19:49.954243Z","submitted_at":"2024-09-10T09:07:12Z","title":"VoiceWukong: Benchmarking Deepfake Voice Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06348","snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"V oiceWukong: Benchmark- ing deepfake voice detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"cited_paper":"/paper/2409.06348","citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:b938c89ccabe2c163d62ef5c76a5b2ccb7a01b94b784e8c66371bf09b4f11e28","observation_id":"6ffaedd5-2299-4623-930f-358301d56a74","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"V oxCPM: Tokenizer-free TTS for context- aware speech generation and true-to-life voice cloning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:bc824e37826b5a7ebfb07fab77bb9ff5ed0946d7f4e68836cca403e390843eea","observation_id":"950a3414-7b38-49a7-aa61-a13cb79234ce","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15621","last_updated":"2026-01-22T03:51:43Z","snapshot_observed_at":"2026-08-13T01:33:42.158497Z","submitted_at":"2026-01-22T03:51:43Z","title":"Qwen3-TTS Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.15621","snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"Qwen3-TTS technical report,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"cited_paper":"/paper/2601.15621","citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:f2316c34e18715a1e3125dd15ca3abf3d19d9e54dfdf5a8c4a3b98ad0ed93080","observation_id":"2e146f2b-a8f6-4d1f-af4b-9903940d981b","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"GLM-TTS technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:9cf5e004236fc71d176e6e8f30b03071e2da972d0a7d4a1ce2b03965e96276f5","observation_id":"68a0d1a4-7021-4d93-b2f0-54f20f471502","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17589","last_updated":"2025-05-27T07:48:34Z","snapshot_observed_at":"2026-08-16T06:12:24.457686Z","submitted_at":"2025-05-23T07:55:21Z","title":"CosyVoice 3: Towards In-the-wild Speech Generation via Scaling-up and Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17589","snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"CosyV oice 3: Towards in-the- wild speech generation via scaling-up and post-training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"cited_paper":"/paper/2505.17589","citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:ca27e1c955cd608d49f2edad556c878c22227358560beefe8703d8b5d386aa08","observation_id":"b2c5c8d5-7e86-4dcc-a741-5a00b9ac6cba","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"Chatterbox: Open-source flow-matching TTS with emotion exaggeration control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:7b89f65f84ed94bfca0aa3f65d20911447e533688c925b516b7878a8754ca616","observation_id":"65fd403b-eba4-4e88-bd02-63e52bd8dbc8","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"FlashLabs Chroma 1.0: A real-time end-to-end spoken dialogue model with personalized voice cloning,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:33e56f0e931e7231ec04463b37e381c87da3e79229280d6999cd47f331d2dd28","observation_id":"28a865e6-e3aa-4a9f-b70a-7a3f5ee61259","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"VibeV oice: Expressive podcast generation with next-token diffusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:bf07e61d0ec6df9b1b977dc11d543504d804c2391699ee52c7bfec2b380230e2","observation_id":"b05d662b-52f6-4a97-8eab-25bfcc4f6c8f","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09943","last_updated":"2024-11-15T04:43:44Z","snapshot_observed_at":"2026-08-18T12:41:13.446582Z","submitted_at":"2024-11-15T04:43:44Z","title":"Zero-shot Voice Conversion with Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09943","snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"Zero-shot voice conversion with diffusion trans- formers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"cited_paper":"/paper/2411.09943","citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:1a274fe5240c24b8da76eae2b2040815a2497e41509af4b61032cafcffb3aed8","observation_id":"5f34df43-1869-47d7-b6a6-8d82c20fac19","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"OpenV oice V2,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:14a71bc874500c5c82ca0c528c97ab1c9a56ec6d218988696df339c29c8cd492","observation_id":"38efa329-864c-4bbf-b6bb-ec12ec4b5878","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"Retrieval-based-voice-conversion- webui (RVC),","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:baf6e1a936125d07832861cb19f4cb9dbc79ee57373d062326cb68d8b22910dc","observation_id":"e870c2ab-c105-4d03-9a41-a9f07ec09df0","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"Lib- riSpeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:3ea76bc102ff2fd35487a09a8b2c5f41e0231b7b8895794877368e78bee9bddb","observation_id":"6b83d2c1-8c61-4865-b9c9-62807d0a051e","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"V oxPopuli: A large-scale multilingual speech corpus for repre- sentation learning, semi-supervised learning and interpretation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:de8a93216f2e3e63a4978b14c0c225e2997f663998219ad595e729194400ef13","observation_id":"82e917fb-db70-4596-a331-9d365cb98701","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"AASIST: A new end-to-end anti- spoofing system using integrated spectro-temporal graph attention networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:74a4dd6fe0a4ec9d308234f5b334825222f23d12d883d1012192431b6fe61091","observation_id":"1a630ca2-b4dc-4b5f-bb76-93290e2ca2ac","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"End-to-end spectro-temporal graph attention networks for speaker verification anti-spoofing and speech deepfake detec- tion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:4cdf08d742d171ee1948cf8f47717b14d90f8fa1e05f5610833ddf79ea43c40a","observation_id":"35f36e40-9467-45b4-92b6-de7669408e9b","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"AST: Audio spectrogram transformer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:6468905654c7f786530ae4baf3f26f20877d22a70952b4be49df25a110c6ab95","observation_id":"d72a4729-7876-4470-89ef-30846ef7db7a","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"ECAPA- TDNN: Emphasized channel attention, propagation and aggrega- tion in TDNN based speaker verification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:65d344657116b47539c072ecae6b6e5c2a2956c86a18f01b53505798324ed345","observation_id":"6df07361-8da8-4235-b522-82cd19aeb932","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:43:46.836705Z","title":"Facer: Contrastive attention based expression recognition via smartphone earpiece speaker,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T03:43:46.836705Z"},"links":{"citing_paper":"/paper/2607.11706"},"observation_digest":"sha256:d70af245609128bbfa0f5cbe8266a6630a1eae37c8a164f3bbcd25ca661c5c28","observation_id":"51f3d8fc-eb85-4e48-af4c-0f87793d4d0b","resolution":{"observed_at":"2026-07-14T03:43:46.836705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.11706","last_updated":"2026-07-13T15:35:29Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-14T23:00:11.774950Z","submitted_at":"2026-07-13T15:35:29Z","title":"VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2607.11706."}