{"as_of":"2026-08-11T13:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83626c2cf54b2faaaa87b8a914a029229250b3643bedaa78d6c28dc3df0e00b0","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T03:10:54.586256Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T03:10:54.586256Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T18:18:50.120496Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"cited_work":{"arxiv_id":"2606.16532","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.16532","snapshot_observed_at":"2026-07-03T18:18:50.120496Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","venue":"cs.SD","work_id":"03a35b92-751c-48e3-80dc-dbf18aa11cdb","year":2026},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"cited_paper":"/paper/2606.16532","citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:4c27e61478405aa3873ca5efb34f063d1394fcc650af7ff782f0290ea1db619f","observation_id":"b2709337-1f50-480d-8755-ab1f124061fb","resolution":{"observed_at":"2026-07-03T18:18:50.121919Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.16532/citation-record","integrity":"/paper/2606.16532/integrity","json":"/paper/2606.16532/citation-record.json","paper":"/paper/2606.16532"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"cited_work":{"arxiv_id":"2606.16532","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.16532","snapshot_observed_at":"2026-07-03T18:18:50.120496Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","venue":"cs.SD","work_id":"03a35b92-751c-48e3-80dc-dbf18aa11cdb","year":2026},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"cited_paper":"/paper/2606.16532","citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:4c27e61478405aa3873ca5efb34f063d1394fcc650af7ff782f0290ea1db619f","observation_id":"b2709337-1f50-480d-8755-ab1f124061fb","resolution":{"observed_at":"2026-07-03T18:18:50.121919Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Problem Formulation LetX∈R F×T denote the log-mel spectrogram of an input utterance withFmel frequency bins andTtime frames","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:c2c0e67fa5a1951de3555512bc2a963cd0984a036f794fe50de55ad4a176a740","observation_id":"5f000568-7916-4645-a252-7ed6bf81d1a0","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"The training set contains 22,617 bonafide and 22,296 spoofed utterances from 107 speakers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:1130e31b40c198ab6ef93b9137d2b0e71edbef41bda157567bff535734af1f9e","observation_id":"5b611413-1210-47b8-a8eb-53f83cc75815","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"In-Domain Detection Table 1 presents detection performance on ASVspoof 2019 LA and 2021 DF","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:c97916aa3915188a83707be3f5f8ac184a1f6b33940935c2c8ad394db8849d91","observation_id":"7a09b897-0b2e-4397-8eb2-f98a95b1576a","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:2fe630c516ca72253386b4e2d4ac3c6d799ad175f96a032b5022aa309f26de99","observation_id":"d7b9ce8b-2601-4a9f-9e95-779b7d8479fb","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"All scientific content, experimental design, implementa- tion, analysis, and conclusions are the sole work of the authors","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:26d8b0e6c474201e1d69850a56d1e74ec7471e0cccb7269a5ffabeb307981204","observation_id":"9934ff58-8428-46ae-9c75-7282310a7ce3","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"An overview of voice conversion and its challenges: From statistical modeling to deep learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:a4811394b74b8627da004d4b55244684e595e20c59cda200794c2d5b4dabaffd","observation_id":"4c206ec4-4a54-4dcf-a494-2cc70a53b0b5","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Any- to-many voice conversion with location-relative sequence-to- sequence modeling,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:dded9db5f75ffdf1d85e2bb18ae6e7b266ed0d97b886df65dd6b19788cf4fc2e","observation_id":"3bcc45aa-1a1c-4f03-b522-e5bd1e86db59","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Yourtts: Towards zero-shot multi-speaker tts and zero-shot voice conversion for everyone,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:0b6402d003dcb20c836dc7e510d7da06cffdb9e950f705d04f775b526aebcb61","observation_id":"c38c9956-27ee-4412-a158-7074f9525966","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Fastspeech 2: Fast and high-quality end-to-end text to speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:a39b7ece7801996046b70e254cfc18df455fe26dec5d93aafe006345f8c3a2d2","observation_id":"b53b4114-718b-480a-a9bd-b2498006260f","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Aasist: Audio anti-spoofing using integrated spectro-temporal graph attention networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:4313fb43115ce245f4d4d9a021a4b28bf64cc968789c6512acb7beb1055980b1","observation_id":"e376d1f8-706a-477b-82dc-c6e18c2667e6","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"End-to-end anti-spoofing with rawnet2,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:c11de21aaf52be256166ca7366dbc46fa12ed4d5e7d83ca023dd03a4763fc30a","observation_id":"e78256e3-975e-4448-8350-752d9c6909f2","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Asvspoof 2019: A large-scale public database of synthesized, converted and replayed speech,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:eb5360a71baca2278f5f347d52398a04739b5d18857e9ff83ff0e129db6486fc","observation_id":"5c0ec15a-ee93-40c3-8a64-45936bf4cc86","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Does audio deepfake detection generalize?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:705a5e03f5f97c06ee6c949dc2c41511d6961fd16f2168280177d4e09989f866","observation_id":"d44b2b89-2630-4aca-918c-7fe0d08b4b50","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Towards generalisable and calibrated audio deepfake detection with self- supervised representations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:a3778774148db6704dd00cbe992561e0464e63881555ff72c19893b49f20706e","observation_id":"4a90bbec-9e6a-4657-8a6f-0910a7433378","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06766","last_updated":"2025-05-10T22:03:07Z","snapshot_observed_at":"2026-08-09T09:30:17.395258Z","submitted_at":"2025-05-10T22:03:07Z","title":"Beyond Identity: A Generalizable Approach for Deepfake Audio Detection","version":1},"cited_work":{"arxiv_id":"2505.06766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.06766","snapshot_observed_at":"2026-07-03T18:18:50.129045Z","title":"Beyond identity: A generalizable approach for deepfake audio detection","venue":null,"work_id":"c020428f-99af-4b56-a11f-ba9fe5ed2c40","year":2025},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"cited_paper":"/paper/2505.06766","citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:64f9d3c78f7314481117f7812c0fe04613493af6df55bd4d13094482fda87bc3","observation_id":"61bccb6d-4a07-4c8a-882d-616b430ce3c9","resolution":{"observed_at":"2026-07-03T18:18:50.130705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14970","last_updated":"2023-08-29T01:50:01Z","snapshot_observed_at":"2026-07-06T16:11:31.948429Z","submitted_at":"2023-08-29T01:50:01Z","title":"Audio Deepfake Detection: A Survey","version":1},"cited_work":{"arxiv_id":"2308.14970","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.14970","snapshot_observed_at":"2026-07-03T18:18:50.126056Z","title":"Audio Deepfake detection: A survey","venue":null,"work_id":"928f5967-be3a-4ade-96df-8dd82f3810e9","year":2023},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"cited_paper":"/paper/2308.14970","citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:a541136faa9fae99fd24d26ecc6f7d0727b3bf68e896aaae25e86630749329bc","observation_id":"c1df668b-f84d-4e9f-9896-15e297fcd924","resolution":{"observed_at":"2026-07-03T18:18:50.127798Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Spoofing-aware speaker verification with un- supervised domain adaptation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:ba603bbc76680e06c5333a26617a5c79f71b6982d981b9d12cbf66f05bf837a3","observation_id":"4f6c9e4d-c146-4536-b510-b0fc8e927ab5","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Domain generalization via aggregation and separation for audio deepfake detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:6ea882246d17a97b0f242cf97afa17a7f90c0a961058057a1fb0ecfe3a4862c8","observation_id":"a56cd63f-0cdc-421b-b530-76e7dc378340","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"ASVspoof 5: Design, collection and validation of resources for spoofing, deepfake, and adversarial attack detec- tion using crowdsourced speech,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:746beb8e04b67bd4c8d497fa9fe9c1d6d97b998981a8d552291c5e526b7f8846","observation_id":"f4c01e9d-be3e-4cde-aef8-32cae2318124","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"A comparison of features for synthetic speech detection,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:11c6bcc25963863df7e218bfcc6e49778be3671e17157e28a59fc87c6cb13c3e","observation_id":"5a2b3a49-075d-4765-9d9b-8efa034be263","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representa- tions,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:e5d2667f33b38e0a5eb84a34d80d516085dcff72fd35442fb1d126b22004a9ee","observation_id":"32088a33-ece5-46b9-b6a9-121d69d71cb7","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Vicomtech audio deepfake detection system based on wav2vec 2.0 for the 2022 add chal- lenge,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:03d09976cecaf4cd49a320f10e3c67d0a2d46cc500363a281acd06528e4c16fc","observation_id":"ca2b5d18-759c-42fb-85c6-fd968ba69e17","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Automatic speaker verification spoofing and deep- fake detection using wav2vec 2.0 and data augmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:17835057426fd80936ee509c9bf4e83fa1333f8d4d53d650975a719f7883635a","observation_id":"6fa79818-1bea-434e-a638-e962df773dc6","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Attentive merging of hidden embeddings from pre- trained speech model for anti-spoofing detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:b9c851b0335d89cc0656dbc1b3eab00c2690ce09246f10d3719da1275b5012dc","observation_id":"2f76aab7-16a0-42e4-ac5f-58b76b7e9ff9","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Nes2net: A lightweight nested architecture for foundation model driven speech anti-spoofing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:b171ec34b9f9df95537f84836540a8e20f587bd7d74b9c93f9cfcc9b4e699764","observation_id":"af079841-1689-4a2f-ab88-08fa18787203","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"X-vectors: Robust dnn embeddings for speaker recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:670d5dea1e1d5e39d917c0bc8cf591e870bb6300e3a3c643d1385796cb18ff43","observation_id":"35cd66e6-a3f7-48da-92b1-d37183322c8b","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Ecapa-tdnn: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:ca8ad4b3e1e4a0917cf043a32db4b80f828eb532bb8ef1c68c7dbc149221a93d","observation_id":"a0ff8a60-3740-4895-a685-5af8363b5e4d","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Un- masking real-world audio deepfakes: A data-centric approach,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:c56f9bb5ddc16c8c526dfa66abcb139970c280d46815e2aebc3e60daa9523433","observation_id":"7e9db595-0a27-4138-99d6-00c1030b6208","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Domain- adversarial training of neural networks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:5981f42c0d98ec58a32e40baa910e65377cfdd9a65429f9a9ed77eea8b7c8dbf","observation_id":"901d6683-775c-4592-8dac-5f91fdbf4bb2","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Representation learning: A review and new perspectives,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:e0df679752de918e163723b9042575cf898d619b2e6935b04cca100ada21beb0","observation_id":"75d9b3e5-0e43-422f-ace7-12effaca9c8a","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Alden: Dual-level disentanglement with meta- learning for generalizable audio deepfake detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:7b69bee70c7c37611714631cffa4d233f1a3d0ff69b1e029e55e515c858c0299","observation_id":"ff10af92-64e0-438d-8ac9-84496de69b5b","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Safeear: Con- tent privacy-preserving audio deepfake detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:46e39ce1b794d22fbe5c1c9df18071e02ae41e56bdf82f2638c09dcdcaefbc09","observation_id":"f5dc4e1b-15f4-4499-8dba-8217c6c7a779","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02543","last_updated":"2025-07-19T17:26:06Z","snapshot_observed_at":"2026-07-06T18:40:31.586903Z","submitted_at":"2024-07-02T07:13:35Z","title":"Towards the Next Frontier in Speech Representation Learning Using Disentanglement","version":2},"cited_work":{"arxiv_id":"2407.02543","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.02543","snapshot_observed_at":"2026-07-03T18:18:50.123192Z","title":"Towards the next frontier in speech representation learning using disentanglement,","venue":null,"work_id":"a13ab67b-a5a1-456d-afe3-87692a2b4c27","year":2024},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"cited_paper":"/paper/2407.02543","citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:3929a037ae11b62e6fe5e0b13c629435e50f21a21a65d82675e90e70dbd0e5b9","observation_id":"8ba94f58-c02c-459a-aeb4-38f2cecb469b","resolution":{"observed_at":"2026-07-03T18:18:50.124843Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"ContentVec: An improved self-supervised speech representation by disentangling speakers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:0dc1171fbf7bbdb89d006db589b6ef7d630092c0b8cb59432057d22b83697d72","observation_id":"2abc9d2c-ad6a-4096-aad2-5eca9edb472f","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Speaker anonymization using orthogonal Householder neural network,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:048ba127e0d0ea8a604c2e55f0150b0df060b7c4de8a03b09412ea2f71040b38","observation_id":"f8c2a733-706f-4e3b-a6e0-282707d29f72","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Speech emo- tion recognition with co-attention based multi-level acoustic infor- mation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:9f176f3e19201b19eac29100d6286db0f79e2b8bdfc1c4dd7c2c6db0894f56b3","observation_id":"d3646b1e-b71f-4941-a4f2-5b14cfd38c9f","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Disentangling spoof trace for generic face anti-spoofing,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:13df4252ff05b89bce44e96e8da693d048e4bff146bde9e2ead49f19dd81f9d3","observation_id":"0ddfa419-d1e4-4f8a-9e8b-c41792b3969c","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Barlow twins: Self-supervised learning via redundancy reduction,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:d3651da900a9bef1b3bd04b3772fd39a6bf4c17032dfe1900f27634dc492df77","observation_id":"4cfb0e0a-efe0-451b-ae58-e44835c96092","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"ASVspoof 2021: accelerating progress in spoofed and deepfake speech detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:b5dbbbfcdaef0a14e99c67e2da23d653754d0eb5c2c69562708e6ccbf460a47e","observation_id":"dfa63194-9c73-455e-98e7-14f3f9904b74","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Arcface: Additive angular margin loss for deep face recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:a23528acf8b358b8c2d27e763c7b1e922ac1402c8f2a62833b9388f4fd436005","observation_id":"5c09c356-6e4e-4145-8f68-2eebad754a87","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T03:10:54.586256Z","title":"Stc antispoofing systems for the asvspoof 2019 challenge,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-27T03:10:54.586256Z"},"links":{"citing_paper":"/paper/2606.16532"},"observation_digest":"sha256:35679ef5e61a29c274009e13db84ad097b0f82b3f32a742c0a9bab88554df33d","observation_id":"4b69ccd5-fead-4090-a9ce-3861c1244b4f","resolution":{"observed_at":"2026-06-27T03:10:54.586256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.16532","last_updated":"2026-06-22T14:00:04Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-04T23:58:43.485060Z","submitted_at":"2026-06-15T10:36:57Z","title":"Dual-Granularity Orthogonal Disentanglement for Generalizable Audio Deepfake Detection"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2606.16532."}