{"as_of":"2026-08-21T03:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:822a19f5a971744a24bc40f7b8b599e572d13c5dc737c01fa975452a6d07bfd0","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T12:34:20.057072Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.04848/citation-record","integrity":"/paper/2607.04848/integrity","json":"/paper/2607.04848/citation-record.json","paper":"/paper/2607.04848"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Audio deepfakes: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:9dd17270bd142c2979c37f241c84610ef7affc7086a264ff6c51ca106c757326","observation_id":"b31a340e-8cf2-4574-b2cd-126cebe3975b","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Available: https://www.frontiersin.org/journals/big- data/articles/10.3389/fdata.2022.1001063","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:c8783565da2ce1086a359367ca4c7776ed8d982468d9f8ae619122ec899eeb23","observation_id":"b784e968-7d39-4882-b3fb-5c68b8493bbd","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Audiobox: Unified audio generation with natural language prompts,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:f85a60d6ce04793b8ce2cd90487bddb53ac0056826da25e763daedb52e61f4ea","observation_id":"548ce5f1-1e12-4bee-897a-0985d5b8c57e","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15821","last_updated":"2023-12-25T22:24:49Z","snapshot_observed_at":"2026-08-17T22:52:14.678531Z","submitted_at":"2023-12-25T22:24:49Z","title":"Audiobox: Unified Audio Generation with Natural Language Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15821","snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Available: https://arxiv.org/abs/2312.15821","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"cited_paper":"/paper/2312.15821","citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:df3c670fe2b5e418a197c29495b30b8bb5e1b3e6978c9efa580a8cb11cb7bffb","observation_id":"a3d23cec-77d5-403f-9493-0bf03a9ec394","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.328528","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:38:00.625926Z","title":"Asvspoof 2021: Towards spoofed and deepfake speech detection in the wild,","venue":null,"work_id":"9b863f83-5bbc-4ed2-85fc-e79603e8547b","year":2021},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:0f9d7a05474d6cfdafb6303072934e0d2cdb03173e0a95edc7d4c532737e3a10","observation_id":"257c9411-0d83-40b1-9986-577e822c9546","resolution":{"observed_at":"2026-07-11T12:38:00.628922Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Environmental sound recognition: A survey,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:a468c44f4525e79eb5c7bc0870d2a8403b9cc611990464606c15ad4784324745","observation_id":"060d2041-d4bf-4a37-a1ee-64839087e3c3","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.7787","last_updated":"2014-09-27T09:47:16Z","snapshot_observed_at":"2026-08-14T23:17:53.174991Z","submitted_at":"2014-09-27T09:47:16Z","title":"Audio Surveillance: a Systematic Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.7787","snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Audio surveillance: a systematic review,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"cited_paper":"/paper/1409.7787","citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:87381c946b417af4c8aa173ca5f68632ff1b1e28e143d430b9b08de3c5856ceb","observation_id":"6723f634-3684-4055-9022-570d53feff0a","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"ASVspoof 2019: Future horizons in spoofed and fake audio detection,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:9b475c646e201ec135a68ea2b7201f98546a951b96c3ec7789322123bd782f4e","observation_id":"1a336e2f-a948-40e8-8210-740617a19f44","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"ASVspoof 2021: Automatic speaker verification spoofing and countermeasures challenge evaluation plan,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:3e4ea2e089edc8720a57d3baee6dc59b0c2afc15a92f991153653790966ba6cb","observation_id":"55b29a97-e982-492a-903e-26b198859c87","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.05080","last_updated":"2022-03-01T10:38:07Z","snapshot_observed_at":"2026-08-20T04:01:31.921281Z","submitted_at":"2021-08-11T07:49:36Z","title":"FakeAVCeleb: A Novel Audio-Video Multimodal Deepfake Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.05080","snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Fakeavceleb: A novel audio-video multimodal deepfake dataset,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"cited_paper":"/paper/2108.05080","citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:32a68b7737b986245cd23eaa0fed5ac87814833204f176db516c69aba5a3c079","observation_id":"e9aa5ae3-14f1-40e6-973f-331f647b1b22","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13701","last_updated":"2023-05-23T05:30:17Z","snapshot_observed_at":"2026-08-16T15:30:48.174950Z","submitted_at":"2023-05-23T05:30:17Z","title":"TO-Rawnet: Improving RawNet with TCN and Orthogonal Regularization for Fake Audio Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13701","snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"To-rawnet: Improving RawNet with TCN and orthogonal regularization for fake audio detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"cited_paper":"/paper/2305.13701","citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:3575acddd62153c71bbc5b2cb27ae29ceda24faa0925b308c5268677045ec904","observation_id":"3e6779e1-87aa-4b93-aad5-977786733425","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.126799","doi":"10.1016/j.neucom.2023.126799","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Twice attention networks for synthetic speech detection,","venue":"Neurocomputing","work_id":"194df992-31cb-47fc-b1c0-731e1c38f57d","year":2023},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:f9578a91e14c162cc2e70feddc55222b494a48b9f73fc1c8915d0b0e61db820d","observation_id":"b904a9a1-d87c-4620-b28a-6b45b8a2ea24","resolution":{"observed_at":"2026-07-11T12:38:00.611125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-07-12T01:20:05.947402+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T01:20:05.947402+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Wavefake: A data set to facilitate audio deepfake detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:df31dd977b6805c80874694401ad034aca69113cd1247f9de777dde8e6419fb7","observation_id":"0501abae-9a1c-49fb-92c4-141c5446984b","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Multi- lingual deepfake speech dataset for robust and generalizable detection,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:afaf7de3644aa3954887a8fc3ee343d698f975c798556f20f7efaa4caa653ad8","observation_id":"7e86ee54-e84c-4270-a00c-aef23850b9b1","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Simple and controllable music generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:1c7218fe0ecb96e357549ec41574f78ed217e7f5ad28fe6393ce561b786b0589","observation_id":"e929f1ce-217c-4328-9d7b-9d9299f121cb","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12503","last_updated":"2023-09-09T15:27:58Z","snapshot_observed_at":"2026-08-16T15:59:22.404915Z","submitted_at":"2023-01-29T17:48:17Z","title":"AudioLDM: Text-to-Audio Generation with Latent Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12503","snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Audioldm: Text-to-audio generation with latent diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"cited_paper":"/paper/2301.12503","citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:42f7fe36d3b28a580c80f2ab1336d4d6012e058097ec48fa4d6c05f4d5f6bd82","observation_id":"6b618a80-5245-450a-b915-ba7b6712dcc8","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05734","last_updated":"2024-05-11T11:24:51Z","snapshot_observed_at":"2026-08-16T15:09:17.721814Z","submitted_at":"2023-08-10T17:55:13Z","title":"AudioLDM 2: Learning Holistic Audio Generation with Self-supervised Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05734","snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Audioldm 2: Learning holistic audio generation with self-supervised pretraining,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"cited_paper":"/paper/2308.05734","citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:cfed11857e967c2ab0c1d13eacc17201d08fe7f80ee4a03f66cdf0cd726cb594","observation_id":"6655ad29-f814-4a34-aaf4-c09ed6593027","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Stable audio: Fast timing-conditioned latent audio diffusion,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:5ba1aa642cca3a19f5dc905a386641bf4481bbf2804b121eea377a597738571c","observation_id":"a6e4163b-9bb6-49a9-a4ca-347fa63eeb76","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Available: https://stability.ai/research/stable-audio-fast- timing-conditioned-latent-audio-diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:5654e97f01f0542215b01ee2419a58cf5688abb014cca3c273db93fa716ff439","observation_id":"ebd3d5fd-e6bf-4fe5-a15b-a259e7a3eb97","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.326873","doi":"10.1109/taslp.2023.3268730","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Diffsound: Discrete diffusion model for text-to-sound generation,","venue":"IEEE/ACM Transactions on Audio Speech and Language Processing","work_id":"3f7fa1f3-6f42-4858-985c-1f6ce8423aa2","year":2023},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:df229bbfe8eda20295b68c8db421576144bf3bd1d9ce552a2fc5e148db620e3b","observation_id":"59f4529d-a39f-4692-a3f8-c01a8d30b9ad","resolution":{"observed_at":"2026-07-11T12:38:00.631632Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-07-12T01:20:06.366035+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T01:20:06.366035+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Make-an-audio: Text-to-audio generation with prompt-enhanced diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:f419b3e50b208009639cf9e33890872c053b22e00e6225ddadff80bee6b0e26e","observation_id":"bc96dca8-13c6-4bd5-963f-c5bb8a245132","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15322","last_updated":"2025-04-07T18:00:00Z","snapshot_observed_at":"2026-08-18T13:59:15.022742Z","submitted_at":"2024-12-19T18:59:55Z","title":"MMAudio: Taming Multimodal Joint Training for High-Quality Video-to-Audio Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15322","snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Mmaudio: Taming multimodal joint training for high-quality video-to-audio synthesis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"cited_paper":"/paper/2412.15322","citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:1a1cd685733b01eb2858deb3c651a455914c7f13b8abaa3bea9b88f4eece31ad","observation_id":"85d98edd-c600-454c-a9dc-983ee4baa906","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21037","last_updated":"2025-04-10T05:01:32Z","snapshot_observed_at":"2026-08-18T08:51:59.333838Z","submitted_at":"2024-12-30T16:02:44Z","title":"TangoFlux: Super Fast and Faithful Text to Audio Generation with Flow Matching and Clap-Ranked Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21037","snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Tangoflux: Super fast and faithful text to audio generation with flow matching and clap-ranked preference optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"cited_paper":"/paper/2412.21037","citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:b0871c1a723cb625a58b85ee54158e175453484a53294071c48634adae3caa40","observation_id":"8b3a5318-e541-410b-ab9d-f7fa63760899","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Envsdd: Benchmarking environmental sound deepfake detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:100025c02c4dac3cde422254445dc259750ddaeb03f53dac74badc4dcf65c823","observation_id":"7f73c209-a9d3-45c4-984e-6d42919806ec","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Compspoof: A dataset and joint learning framework for component-level audio anti-spoofing countermeasures,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:c54134313aced38c5bb915f9c7c583e6e172e79429824061e06bfd4ddefb990e","observation_id":"2cf5ffeb-b342-463b-a9f5-2db4f313ef98","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.10791","last_updated":"2026-06-26T07:49:38Z","snapshot_observed_at":"2026-08-17T02:51:06.941934Z","submitted_at":"2026-06-09T12:42:14Z","title":"Overview of ESDD2: Environment-Aware Speech and Sound Deepfake Detection Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.10791","snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Overview of esdd2: Environment-aware speech and sound deepfake detection challenge,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"cited_paper":"/paper/2606.10791","citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:de946fc56c3d787e4079341568bc7cf9df2db6b34167044b1168dbc86503c1d4","observation_id":"5bf1ba35-306a-4e43-8ba6-63af0b17ca99","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Efficient audio transformer and aasist for environment sound deepfake detection in the esdd 2026 challenge,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:59f23023feb353e3c1d320ebd99cbabf5220136abe00504f3ddb6943758b564d","observation_id":"869d5770-2430-43ba-9208-5f21e1d6f003","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"Clotho: an audio captioning dataset,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:d31d01cf0506cb0b632e2dd8c76c4cc78151c066d495b0af72c656d132e7ac19","observation_id":"9c9316cb-aba9-4b1b-969f-d713cf7a2147","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:724cd7d517d6dee2dd6e2627cddbe3756563cc4e5ceab3735631dc5a293a11fa","observation_id":"9c414d3e-7c7b-461e-b38e-b9a14b3d2470","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"TACOS: Temporally-aligned audio captions for language-audio pretraining,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:43fcfbe84852ab08125fa3a30167d5ef015757515da230aea989aca276875213","observation_id":"bf598def-c5fb-4b6e-8134-b6cb613b0a98","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"WavCaps: A ChatGPT-assisted weakly-labelled audio captioning dataset for audio-language multimodal research,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:c8a8add23c22afe1d72d7323bbfb4bbbf308d875c1e37a44039b6f4035e7200e","observation_id":"e946d516-1ce3-42b5-b897-81db2a2cbc5d","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"AASIST: Audio anti-spoofing using integrated spectro-temporal graph attention networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:4d8cf150f9f5e4e351a29e868c282657508df9c171340785396f54440ade7a6f","observation_id":"002ccebc-1351-4527-83be-c7d0c55709e4","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:34:20.057072Z","title":"A dataset and taxonomy for urban sound research,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-11T12:34:20.057072Z"},"links":{"citing_paper":"/paper/2607.04848"},"observation_digest":"sha256:6864d391567a7f987fd24590c8f6284ed4492382ede466c056a33f697b7b3ed2","observation_id":"e0f64efa-bbe6-4238-b750-25c4dd1a3d78","resolution":{"observed_at":"2026-07-11T12:34:20.057072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.04848","last_updated":"2026-07-06T09:19:03Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-17T14:48:24.065098Z","submitted_at":"2026-07-06T09:19:03Z","title":"SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2607.04848."}