{"as_of":"2026-08-07T09:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:31980c91550c464f082fc93dd4ae09e51099219fb43a0ffbcd80adee5e6fb0ce","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:13:42.808724Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T13:18:12.799615Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2509.03526","last_updated":"2026-05-20T03:07:46Z","snapshot_observed_at":"2026-08-07T01:53:38.136292Z","submitted_at":"2025-08-25T07:31:48Z","title":"Enhancing Speech Large Language Models through Reinforced Behavior Alignment","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-21T22:23:52.392075Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2509.03526"},"observation_digest":"sha256:e3898ad911d7499c926b0240c94adfec9a0dddea657879a84e6475eade49b32b","observation_id":"0c6d9238-9845-4a4d-85db-f2abf53711b6","resolution":{"observed_at":"2026-05-21T22:24:23.523554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-08-04T10:13:42.808724Z","title":"Alec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sas- try, Amanda Askell, Pamela Mishkin, Jack Clark, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.11098","last_updated":"2026-07-06T08:06:32Z","snapshot_observed_at":"2026-08-04T21:47:58.063486Z","submitted_at":"2025-10-13T07:45:52Z","title":"VCB Bench: An Evaluation Benchmark for Audio-Grounded Large Language Model Conversational Agents","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T10:13:42.808724Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2510.11098"},"observation_digest":"sha256:c1595a04a8c2255a8951c4ccfa1898d81f217ae87d7095c742fe944dfbda4425","observation_id":"0fdeb41d-e64d-44fc-b20b-615f62936534","resolution":{"observed_at":"2026-08-04T10:13:42.808724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2603.17837","last_updated":"2026-06-04T13:47:38Z","snapshot_observed_at":"2026-08-02T07:45:21.753896Z","submitted_at":"2026-03-18T15:30:29Z","title":"The Silent Thought: Modeling Internal Cognition in Full-Duplex Spoken Dialogue Models via Latent Reasoning","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T08:34:56.898815Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2603.17837"},"observation_digest":"sha256:0d4233ab6b497e9adde7b4bddb15a0227751b794dc31362c4f6ec1e32a2240c0","observation_id":"a9cf42d6-53ed-4d9f-9519-77c0fc8aab83","resolution":{"observed_at":"2026-05-15T08:35:18.336465Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2603.17837","last_updated":"2026-06-04T13:47:38Z","snapshot_observed_at":"2026-08-02T07:45:21.753896Z","submitted_at":"2026-03-18T15:30:29Z","title":"The Silent Thought: Modeling Internal Cognition in Full-Duplex Spoken Dialogue Models via Latent Reasoning","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T10:43:27.176535Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2603.17837"},"observation_digest":"sha256:548c45d92cbb5df6effeda7f259c7b15c74ba42834bc70a42d1c14e20465bf6b","observation_id":"e36d694d-e081-4521-af19-311c41dca4b8","resolution":{"observed_at":"2026-05-21T10:44:07.731649Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-13T22:57:11.059962Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.17837","last_updated":"2026-06-04T13:47:38Z","snapshot_observed_at":"2026-08-02T07:45:21.753896Z","submitted_at":"2026-03-18T15:30:29Z","title":"The Silent Thought: Modeling Internal Cognition in Full-Duplex Spoken Dialogue Models via Latent Reasoning","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T22:57:11.059962Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2603.17837"},"observation_digest":"sha256:3fd174d198aedf40b5d1946ff5bfb88a232a2ae9b479729ecc2f6ad3f8b9f66c","observation_id":"f41ea930-1e84-4425-8d15-f62eaa6ab6c1","resolution":{"observed_at":"2026-07-13T22:57:11.059962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2605.06765","last_updated":"2026-05-07T17:59:56Z","snapshot_observed_at":"2026-08-02T05:36:23.979419Z","submitted_at":"2026-05-07T17:59:56Z","title":"VITA-QinYu: Expressive Spoken Language Model for Role-Playing and Singing","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-11T01:03:09.942984Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2605.06765"},"observation_digest":"sha256:7c381079a13e106f02578339b89cda788dbb3af29ba011df4a2abbf63d563997","observation_id":"c9855641-f6f8-4435-b6ac-d3fd4a17243b","resolution":{"observed_at":"2026-05-11T04:50:56.112480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2605.27190","last_updated":"2026-05-26T15:43:11Z","snapshot_observed_at":"2026-08-06T18:21:13.610239Z","submitted_at":"2026-05-26T15:43:11Z","title":"Learning When to Think While Listening in Large Audio-Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T18:37:34.409802Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2605.27190"},"observation_digest":"sha256:e514892de3c2469f7b25cce61062f3b6202bcb769645389852f230fbd86af21b","observation_id":"dd0c267f-3395-41ff-8ed8-11076ca15720","resolution":{"observed_at":"2026-06-29T18:43:50.740325Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2606.05121","last_updated":"2026-06-03T17:26:11Z","snapshot_observed_at":"2026-08-02T17:56:34.317060Z","submitted_at":"2026-06-03T17:26:11Z","title":"Audio Interaction Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:05.062465Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2606.05121"},"observation_digest":"sha256:ff883f065f27652bb64e69b21ac11e07b2bb737b25a926041b38da49fcc30771","observation_id":"5b065715-e004-4abb-b17d-6528a168b85c","resolution":{"observed_at":"2026-07-02T10:46:52.399346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2606.12199","last_updated":"2026-06-10T15:19:15Z","snapshot_observed_at":"2026-08-06T23:04:23.994908Z","submitted_at":"2026-06-10T15:19:15Z","title":"Which Speech Representation Better Matches Text-Native Reasoning? A Study of Speech-Text Alignment on Frame Rate and Representation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-27T08:18:23.182355Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2606.12199"},"observation_digest":"sha256:d37016b719cf0e2898bc4f1862257962ea12d2c6b84db565f355457a1906703e","observation_id":"814d8f26-395c-4231-92d2-c67a346ae863","resolution":{"observed_at":"2026-07-03T13:18:12.801146Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2606.30145","last_updated":"2026-06-29T11:22:50Z","snapshot_observed_at":"2026-07-07T00:04:00.652252Z","submitted_at":"2026-06-29T11:22:50Z","title":"FacePlex: Full-Duplex Joint Speech-Facial Motion Generation for Conversational Avatars","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T06:38:28.718164Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2606.30145"},"observation_digest":"sha256:f62a0dde4c54b8baa8ec1e4cf5ff8d623b06e463f4e58809c82b6e0d4d9d3c9e","observation_id":"8974942b-412e-4800-887f-6fa99e2acc01","resolution":{"observed_at":"2026-06-30T06:44:19.396461Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-08-01T11:20:17.845680Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.845680Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:7b6ba4dc53182e4f7228151ba4f7e1cab741519d9da326db9df701d02deee04f","observation_id":"bee2084b-cdfb-4f8b-9679-bb172797f891","resolution":{"observed_at":"2026-08-01T11:20:17.845680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.15255/citation-record","integrity":"/paper/2305.15255/integrity","json":"/paper/2305.15255/citation-record.json","paper":"/paper/2305.15255"},"outbound":[],"paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2305.15255."}