{"as_of":"2026-08-20T07:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea9606469ebefac881a930f370f3af59924e3b972cd95011e8ad632356ed143e","coverage":[{"denominator":11,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T14:13:50.737253Z","state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.07985/citation-record","integrity":"/paper/2607.07985/integrity","json":"/paper/2607.07985/citation-record.json","paper":"/paper/2607.07985"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12705","last_updated":"2025-07-17T00:39:18Z","snapshot_observed_at":"2026-08-13T13:24:03.399635Z","submitted_at":"2025-07-17T00:39:18Z","title":"AudioJudge: Understanding What Works in Large Audio Model Based Speech Evaluation","version":1},"cited_work":{"arxiv_id":"2507.12705","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.12705","snapshot_observed_at":"2026-07-10T14:17:10.080959Z","title":"AudioJudge: Understanding what works in large audio model based speech evaluation","venue":"cs.CL","work_id":"3a4de4a7-94a2-465d-ba13-e5b6e642c6d1","year":2025},"citing_paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","snapshot_observed_at":"2026-08-07T05:14:48.269155Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-10T14:13:50.737253Z"},"links":{"cited_paper":"/paper/2507.12705","citing_paper":"/paper/2607.07985"},"observation_digest":"sha256:bb02cbb194a2dc4d0fd536114ebb68dafdbf06757e67735eafafdbed1049e8d9","observation_id":"bd31e340-2dc2-43fe-8ee5-679705374780","resolution":{"observed_at":"2026-07-10T14:17:10.083198Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:17:10.361225Z","title":"Audio large language models can be descriptive speech quality evaluators,","venue":null,"work_id":"6808c0a1-3d9f-4869-9ca2-7029ff0b9ead","year":null},"citing_paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","snapshot_observed_at":"2026-08-07T05:14:48.269155Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-10T14:13:50.737253Z"},"links":{"citing_paper":"/paper/2607.07985"},"observation_digest":"sha256:e93a899b9cd32f66f58f9925af0f903e180c9351e745114714239928a3f8575f","observation_id":"cecdee03-1df9-4d8c-b611-48ebb03e34da","resolution":{"observed_at":"2026-07-10T14:17:10.365750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.08238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:17:10.071914Z","title":"SpeechQualityLLM: Llm-based multimodal assessment of speech quality","venue":null,"work_id":"cd22052c-c03d-44ed-b817-075447dde217","year":2025},"citing_paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","snapshot_observed_at":"2026-08-07T05:14:48.269155Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-10T14:13:50.737253Z"},"links":{"citing_paper":"/paper/2607.07985"},"observation_digest":"sha256:daa5de94fa212fd02d4c5119f5a40db287c0d29f01950ca1c37b392415bbea29","observation_id":"0d40c82e-b9f3-4ec0-a22d-b143d45943ad","resolution":{"observed_at":"2026-07-10T14:17:10.073760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:17:10.366383Z","title":"Interval estimation for the difference between independent proportions: comparison of eleven methods,","venue":null,"work_id":"f7f949d5-a6c1-4db8-a1fc-289a84371330","year":1998},"citing_paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","snapshot_observed_at":"2026-08-07T05:14:48.269155Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-10T14:13:50.737253Z"},"links":{"citing_paper":"/paper/2607.07985"},"observation_digest":"sha256:bd70c3ff05bde4ffebcd1e649c208f0348468a0800fcd136e2599cd0c2fa11f8","observation_id":"981201bd-73b8-472f-927d-f5b3bc4db1b7","resolution":{"observed_at":"2026-07-10T14:17:10.367838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:17:10.371135Z","title":"ITU-T Recommendation P.808: Subjective evalua- tion of speech quality with a crowdsourcing approach,","venue":null,"work_id":"fa974983-272a-4653-a5d8-d69cf035a72a","year":2021},"citing_paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","snapshot_observed_at":"2026-08-07T05:14:48.269155Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-10T14:13:50.737253Z"},"links":{"citing_paper":"/paper/2607.07985"},"observation_digest":"sha256:867a64dd26be4f8452b817bb273924a63a5c8c3b7cb23a632a8a39c0f55ea407","observation_id":"f1998f89-b570-4f77-aeae-9620e3a19786","resolution":{"observed_at":"2026-07-10T14:17:10.372691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:17:10.343117Z","title":"Krippendorff,Content Analysis: An Introduction to its Methodology, 4th ed., Thousand Oaks, CA: SAGE Publications, 2018","venue":null,"work_id":"2bb62a3c-df34-442d-bac6-250b124412c4","year":2018},"citing_paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","snapshot_observed_at":"2026-08-07T05:14:48.269155Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-10T14:13:50.737253Z"},"links":{"citing_paper":"/paper/2607.07985"},"observation_digest":"sha256:29428761cec97db746482f3535ac561487160a87539fd10bfae406a5450e4bad","observation_id":"cf5cbe06-84c3-43e3-a639-b15fb57af392","resolution":{"observed_at":"2026-07-10T14:17:10.359811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:17:10.369186Z","title":"LALM Judge Validation on Full-Duplex Voice Agents,","venue":null,"work_id":"7647bbb3-99bf-4773-b1bc-19e110aeea4f","year":2026},"citing_paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","snapshot_observed_at":"2026-08-07T05:14:48.269155Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-10T14:13:50.737253Z"},"links":{"citing_paper":"/paper/2607.07985"},"observation_digest":"sha256:ac0befda83a6cbde4da44c4de8ba3cf6d3d3d48d74225461ac645d9acbb48943","observation_id":"994dd9ee-9fca-4aef-aae6-982ac4586c12","resolution":{"observed_at":"2026-07-10T14:17:10.370527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04721","last_updated":"2025-08-16T05:46:19Z","snapshot_observed_at":"2026-08-16T12:52:23.297044Z","submitted_at":"2025-03-06T18:59:16Z","title":"Full-Duplex-Bench: A Benchmark to Evaluate Full-duplex Spoken Dialogue Models on Turn-taking Capabilities","version":3},"cited_work":{"arxiv_id":"2503.04721","doi":"10.48550/arxiv.2503.04721","metadata_source":"pith","pith_arxiv_id":"2503.04721","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In2024 IEEE Spo- ken Language Technology Workshop (SLT), pages 1115–1122","venue":"cs.CL","work_id":"8553d8cf-0da9-40b7-a402-7c170c79df4b","year":2025},"citing_paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","snapshot_observed_at":"2026-08-07T05:14:48.269155Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-10T14:13:50.737253Z"},"links":{"cited_paper":"/paper/2503.04721","citing_paper":"/paper/2607.07985"},"observation_digest":"sha256:26f8b800fd4cb2f0f54e2ec1fb010f0a814fcae3d4df1feff02257c84b8e0f50","observation_id":"25971a8a-8c26-46ea-87ba-1e2cf16b58d8","resolution":{"observed_at":"2026-07-10T14:17:10.076707Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:18:51.434968+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:18:51.434968+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07838","last_updated":"2026-04-26T17:52:36Z","snapshot_observed_at":"2026-08-18T11:29:30.160630Z","submitted_at":"2025-10-09T06:30:07Z","title":"Full-Duplex-Bench-v2: A Multi-Turn Evaluation Framework for Duplex Dialogue Systems with an Automated Examiner","version":2},"cited_work":{"arxiv_id":"2510.07838","doi":"10.48550/arxiv.2510.07838","metadata_source":"pith","pith_arxiv_id":"2510.07838","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Full-Duplex-Bench-v2: A Multi-Turn Evaluation Framework for Duplex Dialogue Systems with an Automated Examiner","venue":"eess.AS","work_id":"3d3db706-1500-4317-80ae-7aa3e12a0c74","year":2025},"citing_paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","snapshot_observed_at":"2026-08-07T05:14:48.269155Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-10T14:13:50.737253Z"},"links":{"cited_paper":"/paper/2510.07838","citing_paper":"/paper/2607.07985"},"observation_digest":"sha256:f494fb84dcd503061a51ceeb5c3ac6ff63814073988672a00258c3ad4111b6e4","observation_id":"e1514b4b-bb24-402a-9d18-b0c2a5cf5632","resolution":{"observed_at":"2026-07-10T14:17:10.079665Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-08-19T21:31:31.421076Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2402.07729","doi":"10.48550/arxiv.2402.07729","metadata_source":"pith","pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Air-bench: Benchmarking large audio-language models via generative comprehension","venue":"eess.AS","work_id":"d370d7c7-6672-4149-b423-fd65d5cc3cd1","year":2024},"citing_paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","snapshot_observed_at":"2026-08-07T05:14:48.269155Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-10T14:13:50.737253Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2607.07985"},"observation_digest":"sha256:b0e28316329e0075fcc1270403a204f8caf35bf41e0d8be17af5b6ed380d1015","observation_id":"94cd768e-0a03-4f15-8b22-c35b40ebdf73","resolution":{"observed_at":"2026-07-10T14:17:10.085901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04667","last_updated":"2025-04-02T15:17:02Z","snapshot_observed_at":"2026-08-19T22:41:41.415224Z","submitted_at":"2024-08-06T16:43:35Z","title":"Non-Determinism of \"Deterministic\" LLM Settings","version":5},"cited_work":{"arxiv_id":"2408.04667","doi":"10.48550/arxiv.2408.04667","metadata_source":"pith","pith_arxiv_id":"2408.04667","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llm stability: A detailed analysis with some surprises","venue":"cs.CL","work_id":"2deedf62-78bc-49dd-8891-fb47f06c77af","year":2024},"citing_paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","snapshot_observed_at":"2026-08-07T05:14:48.269155Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-10T14:13:50.737253Z"},"links":{"cited_paper":"/paper/2408.04667","citing_paper":"/paper/2607.07985"},"observation_digest":"sha256:9adc6d39112f643bbd4dbb22fd58559f576e6386d24669de18492d35abcfe62f","observation_id":"0006f4aa-2bad-4c1e-824a-dfad92273668","resolution":{"observed_at":"2026-07-10T14:17:10.070543Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T05:14:48.269155Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents"},"reference_resolution":{"displayed":11,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":4,"verified_fuzzy":5},"total_outbound_references":11},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 11 of 11 outbound references and 0 inbound Pith citation observations for arXiv:2607.07985."}