{"as_of":"2026-08-11T01:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a4beba9b0b57aae5b64c19f924ef531dc419cc918bdccf5a4ca99b26c5963fe4","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:34:37.579626Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T11:41:04.094259Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.17667","last_updated":"2025-03-27T03:50:10Z","snapshot_observed_at":"2026-08-04T18:12:22.604177Z","submitted_at":"2024-12-23T15:53:21Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17667","snapshot_observed_at":"2026-08-10T20:34:37.579626Z","title":"Versa: A versatile evaluation toolkit for speech, audio, and music,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08238","last_updated":"2026-06-05T17:32:46Z","snapshot_observed_at":"2026-08-10T20:27:08.151956Z","submitted_at":"2025-01-14T16:26:14Z","title":"CodecFake+: Codec-Based Resynthesized Data as a Proxy for Detecting CodecFake Speech","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T20:34:37.579626Z"},"links":{"cited_paper":"/paper/2412.17667","citing_paper":"/paper/2501.08238"},"observation_digest":"sha256:98ec6eb60585ed99a0542f03e64a3e990634c1a0dc74bfbf9321e124038924c9","observation_id":"0bd20adb-da0f-4bc5-927a-28128590099a","resolution":{"observed_at":"2026-08-10T20:34:37.579626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17667","last_updated":"2025-03-27T03:50:10Z","snapshot_observed_at":"2026-08-04T18:12:22.604177Z","submitted_at":"2024-12-23T15:53:21Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17667","snapshot_observed_at":"2026-08-07T15:28:01.173993Z","title":"Versa: A versatile evaluation toolkit for speech, audio, and music,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15061","last_updated":"2025-05-21T03:30:23Z","snapshot_observed_at":"2026-08-07T15:22:42.403133Z","submitted_at":"2025-05-21T03:30:23Z","title":"SHEET: A Multi-purpose Open-source Speech Human Evaluation Estimation Toolkit","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:28:01.173993Z"},"links":{"cited_paper":"/paper/2412.17667","citing_paper":"/paper/2505.15061"},"observation_digest":"sha256:07bf2b410657c8f16159d5bc4cd4b23d7cd54e30ac13c09c3355f5fe350d52a1","observation_id":"2ca48c2f-7018-4db2-8bf8-a2f6be8817d2","resolution":{"observed_at":"2026-08-07T15:28:01.173993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17667","last_updated":"2025-03-27T03:50:10Z","snapshot_observed_at":"2026-08-04T18:12:22.604177Z","submitted_at":"2024-12-23T15:53:21Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17667","snapshot_observed_at":"2026-08-07T13:52:58.072917Z","title":"VERSA: A versatile evaluation toolkit for speech, audio, and music,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20741","last_updated":"2025-05-27T05:31:19Z","snapshot_observed_at":"2026-08-07T23:52:33.743427Z","submitted_at":"2025-05-27T05:31:19Z","title":"Uni-VERSA: Versatile Speech Assessment with a Unified Network","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:52:58.072917Z"},"links":{"cited_paper":"/paper/2412.17667","citing_paper":"/paper/2505.20741"},"observation_digest":"sha256:0545971a57b92f4e52b936c67b6d17ac07b7227f83e5843e94c9d6328aaac849","observation_id":"1606d301-34a1-41de-abd4-c4c4afdc96db","resolution":{"observed_at":"2026-08-07T13:52:58.072917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17667","last_updated":"2025-03-27T03:50:10Z","snapshot_observed_at":"2026-08-04T18:12:22.604177Z","submitted_at":"2024-12-23T15:53:21Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17667","snapshot_observed_at":"2026-08-07T13:10:18.545560Z","title":"VERSA: A Versatile Eval- uation Toolkit for Speech, Audio, and Music,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22515","last_updated":"2025-05-28T16:03:03Z","snapshot_observed_at":"2026-08-07T13:02:57.094366Z","submitted_at":"2025-05-28T16:03:03Z","title":"Towards General Discrete Speech Codec for Complex Acoustic Environments: A Study of Reconstruction and Downstream Task Consistency","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:10:18.545560Z"},"links":{"cited_paper":"/paper/2412.17667","citing_paper":"/paper/2505.22515"},"observation_digest":"sha256:574fe0f98023771ee08461f1ddeb76a40ab456de28515a8db8919f7c6c588f3f","observation_id":"c15c2178-688d-4af4-8e2d-1d99a5850cd5","resolution":{"observed_at":"2026-08-07T13:10:18.545560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17667","last_updated":"2025-03-27T03:50:10Z","snapshot_observed_at":"2026-08-04T18:12:22.604177Z","submitted_at":"2024-12-23T15:53:21Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17667","snapshot_observed_at":"2026-08-07T12:33:35.646519Z","title":"Versa: A versatile evaluation toolkit for speech, audio, and music,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24304","last_updated":"2025-05-30T07:35:40Z","snapshot_observed_at":"2026-08-07T12:23:41.728446Z","submitted_at":"2025-05-30T07:35:40Z","title":"A Perception-Based L2 Speech Intelligibility Indicator: Leveraging a Rater's Shadowing and Sequence-to-sequence Voice Conversion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:35.646519Z"},"links":{"cited_paper":"/paper/2412.17667","citing_paper":"/paper/2505.24304"},"observation_digest":"sha256:c3f5bd2fd108743f0ddcd6f528b786ba2fbdceda2f1500b99e6d10bc1e46cdd8","observation_id":"fd93df1e-f37e-4e32-87c0-85a1ab98ceeb","resolution":{"observed_at":"2026-08-07T12:33:35.646519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17667","last_updated":"2025-03-27T03:50:10Z","snapshot_observed_at":"2026-08-04T18:12:22.604177Z","submitted_at":"2024-12-23T15:53:21Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17667","snapshot_observed_at":"2026-08-07T12:04:32.968338Z","title":"Versa: A versatile evaluation toolkit for speech, audio, and music,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00722","last_updated":"2025-05-31T21:43:37Z","snapshot_observed_at":"2026-08-09T13:25:00.234934Z","submitted_at":"2025-05-31T21:43:37Z","title":"Chain-of-Thought Training for Open E2E Spoken Dialogue Systems","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:04:32.968338Z"},"links":{"cited_paper":"/paper/2412.17667","citing_paper":"/paper/2506.00722"},"observation_digest":"sha256:c32ae7aa1fe0331f5bff13b81986379a9377c0fa9cbeaf3484579b0948f05842","observation_id":"bce3c563-952d-44de-802d-51e9c9e8c4c1","resolution":{"observed_at":"2026-08-07T12:04:32.968338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17667","last_updated":"2025-03-27T03:50:10Z","snapshot_observed_at":"2026-08-04T18:12:22.604177Z","submitted_at":"2024-12-23T15:53:21Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17667","snapshot_observed_at":"2026-08-06T23:35:37.473556Z","title":"Versa: A versatile evaluation toolkit for speech, au- dio, and music,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17611","last_updated":"2025-06-21T06:30:59Z","snapshot_observed_at":"2026-08-10T07:54:14.180718Z","submitted_at":"2025-06-21T06:30:59Z","title":"OpusLM: A Family of Open Unified Speech Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T23:35:37.473556Z"},"links":{"cited_paper":"/paper/2412.17667","citing_paper":"/paper/2506.17611"},"observation_digest":"sha256:14faf441edd421267768987a9ed3990825101818bcf32ad3a507263a05e7b358","observation_id":"65ee1f7f-35da-48d7-a95e-209464a251ed","resolution":{"observed_at":"2026-08-06T23:35:37.473556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17667","last_updated":"2025-03-27T03:50:10Z","snapshot_observed_at":"2026-08-04T18:12:22.604177Z","submitted_at":"2024-12-23T15:53:21Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17667","snapshot_observed_at":"2026-08-06T16:13:17.782234Z","title":"VERSA: A versatile evaluation toolkit for speech, audio, and music,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14129","last_updated":"2026-07-13T00:23:40Z","snapshot_observed_at":"2026-08-10T02:00:06.446809Z","submitted_at":"2025-07-18T17:57:46Z","title":"OpenBEATs: A Fully Open-Source General-Purpose Audio Encoder","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:13:17.782234Z"},"links":{"cited_paper":"/paper/2412.17667","citing_paper":"/paper/2507.14129"},"observation_digest":"sha256:a3b9aacc2d37ea7b143acb692a66b5856cce43858235c207fc449b7d52968f18","observation_id":"ebe10833-f3ec-4813-9fec-af94470420a4","resolution":{"observed_at":"2026-08-06T16:13:17.782234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17667","last_updated":"2025-03-27T03:50:10Z","snapshot_observed_at":"2026-08-04T18:12:22.604177Z","submitted_at":"2024-12-23T15:53:21Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17667","snapshot_observed_at":"2026-08-05T15:00:14.058277Z","title":"Versa: A versatile evaluation toolkit for speech, audio, and music","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20660","last_updated":"2025-08-28T11:07:36Z","snapshot_observed_at":"2026-08-07T03:22:53.746027Z","submitted_at":"2025-08-28T11:07:36Z","title":"CodecBench: A Comprehensive Benchmark for Acoustic and Semantic Evaluation","version":1},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-05T15:00:14.058277Z"},"links":{"cited_paper":"/paper/2412.17667","citing_paper":"/paper/2508.20660"},"observation_digest":"sha256:c1fb2a7ba16a1b21986a964e95eb2ba5ed72a6edfeaf999946deb71682ceb7b6","observation_id":"2fb3cf35-e48e-468f-83b3-8bc50d89a366","resolution":{"observed_at":"2026-08-05T15:00:14.058277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17667","last_updated":"2025-03-27T03:50:10Z","snapshot_observed_at":"2026-08-04T18:12:22.604177Z","submitted_at":"2024-12-23T15:53:21Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","version":2},"cited_work":{"arxiv_id":"2412.17667","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.17667","snapshot_observed_at":"2026-08-05T11:41:04.094259Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","venue":"cs.SD","work_id":"82d2e034-d9ca-4484-8af3-96ba81acac25","year":2024},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.200360Z"},"links":{"cited_paper":"/paper/2412.17667","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:1dbed14b002304f8777ea5fd31c77c8578ea99185d4ed671caf50ab9ad3b841e","observation_id":"b8806d74-13dd-4cc4-ba8a-076b351a8004","resolution":{"observed_at":"2026-08-05T11:41:04.098006Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.17667/citation-record","integrity":"/paper/2412.17667/integrity","json":"/paper/2412.17667/citation-record.json","paper":"/paper/2412.17667"},"outbound":[],"paper":{"arxiv_id":"2412.17667","last_updated":"2025-03-27T03:50:10Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-04T18:12:22.604177Z","submitted_at":"2024-12-23T15:53:21Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2412.17667."}