{"as_of":"2026-08-06T04:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:92729a5cf318fde9dee0caa9b504b3ebbbe41282edfcb6b7996fd2b1505a7e57","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T02:40:05.812426Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.11192/citation-record","integrity":"/paper/2605.11192/integrity","json":"/paper/2605.11192/citation-record.json","paper":"/paper/2605.11192"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:a7c0e00f4a1fadd79f6af09949fc75d8d40f175e620e84ff22711a9e2aab5464","observation_id":"26755131-f83a-4d75-9c80-57d418cbb8de","resolution":{"observed_at":"2026-05-13T02:42:08.298187Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11262","last_updated":"2020-05-22T16:26:54Z","snapshot_observed_at":"2026-08-04T10:15:33.124350Z","submitted_at":"2020-05-22T16:26:54Z","title":"LibriMix: An Open-Source Dataset for Generalizable Speech Separation","version":1},"cited_work":{"arxiv_id":"2005.11262","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.11262","snapshot_observed_at":"2026-07-10T12:57:07.566849Z","title":"LibriMix: An open-source dataset for generalizable speech separation","venue":"eess.AS","work_id":"53c02064-c23e-434f-825d-3b1af09a75aa","year":2020},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"cited_paper":"/paper/2005.11262","citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:962ce4d2eaefecc69db8eeaae66060f5e941ac26cc8f20b70a4f71b7607f6c43","observation_id":"0aa1a2e2-b0ae-4882-a625-91c5e647e3b5","resolution":{"observed_at":"2026-05-13T02:42:08.303081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:77ba4ecf86284aa12d6102e5eb29a070e2c94290d6c6cc0300dd13fe64db66d9","observation_id":"3d1b911d-cbbd-4290-b9d7-f848c3a4f4d8","resolution":{"observed_at":"2026-05-13T02:42:08.293827Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":"2410.00037","doi":"10.1121/1.1906946","metadata_source":"pith","pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moshi: a speech-text foundation model for real-time dialogue","venue":"eess.AS","work_id":"3104332b-d279-44c8-aaa7-3d5a13c01832","year":2024},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:154236a4bf3523d44cd5f96154d4a7da7645dc38e8f6f7ce33141665689c60f0","observation_id":"ca134844-a0ef-4a1c-a352-4d79de6f1246","resolution":{"observed_at":"2026-05-13T02:42:08.267606Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:1b65a1f3b1ff5f2188524dd8da11aabc07c55537aba1ac6136c708589697fe6e","observation_id":"23dead95-c35c-4e0e-953c-eb86556de61b","resolution":{"observed_at":"2026-05-13T02:42:08.272249Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":"2401.04088","doi":"10.48550/arxiv.2401.04088","metadata_source":"pith","pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixtral of Experts","venue":"cs.LG","work_id":"0de8c352-9daa-4e1e-8c7b-3d0dec69f369","year":2024},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:f3d94e2467a93f2c05db9e924139561a8b8f2779ff079f70dff86ed930a62955","observation_id":"f3bc3501-d615-4054-b0a7-ae8f62f292d4","resolution":{"observed_at":"2026-05-13T02:42:08.261695Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00233","last_updated":"2024-11-28T12:31:04Z","snapshot_observed_at":"2026-07-06T18:08:00.410061Z","submitted_at":"2024-04-30T22:51:36Z","title":"SemantiCodec: An Ultra Low Bitrate Semantic Audio Codec for General Sound","version":2},"cited_work":{"arxiv_id":"2405.00233","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00233","snapshot_observed_at":"2026-07-04T08:29:41.897234Z","title":"Semanticodec: An ultra low bitrate semantic audio codec for general sound","venue":null,"work_id":"76ea05f9-818c-4774-86d1-830555ded69a","year":2024},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"cited_paper":"/paper/2405.00233","citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:31db1bb9d775ba4281d4f3023f708d67e28a9d6af2bca9dd6eb7597f469c7318","observation_id":"0a5eae74-5677-4857-a833-0b5290bc3040","resolution":{"observed_at":"2026-05-13T02:42:08.277159Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05755","last_updated":"2024-10-18T19:18:41Z","snapshot_observed_at":"2026-07-06T17:27:29.050237Z","submitted_at":"2024-02-08T15:39:32Z","title":"Spirit LM: Interleaved Spoken and Written Language Model","version":2},"cited_work":{"arxiv_id":"2402.05755","doi":"10.48550/arxiv.2402.05755","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05755","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Costa-jussà, Maha Elbayad, Sravya Popuri, Paul-Ambroise Duquenne, Robin Algayres, Ruslan Mavlyutov, Itai Gat, et al","venue":"arXiv (Cornell University)","work_id":"68de0d08-16b3-465c-8cd5-3ee2f70c1524","year":2024},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"cited_paper":"/paper/2402.05755","citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:491af657ae04830d6b5728cd8b3fb45d108fdee168472c6ae1d585baee902d04","observation_id":"fdb80f78-d43b-4f80-b29f-4a8abc29354b","resolution":{"observed_at":"2026-05-13T02:42:08.307524Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":"2601.03267","doi":"10.48550/arxiv.2601.03267","metadata_source":"pith","pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI GPT-5 System Card","venue":"cs.CL","work_id":"ca87689a-0d29-4476-b504-b65dbbb08af4","year":2025},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:4ef63fce8c906435ff9cc55e46f55701319f644828667f7a9aec446051d30419","observation_id":"fe393c50-d099-4981-b76b-827c9783f5e8","resolution":{"observed_at":"2026-05-13T02:42:08.284880Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-03T00:38:11.458508+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T00:38:11.458508+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-02T20:06:32.256011Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":"2301.02111","doi":"10.48550/arxiv.2301.02111","metadata_source":"pith","pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","venue":"cs.CL","work_id":"de8fb688-dd63-4942-92f6-66d98d5b6db2","year":2023},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:39c59e8625b5992c5ab494c37f615c4c6f6e7f1858461084ef8389fbfffd65a0","observation_id":"03070e2a-ae51-46c4-babf-7980868c548a","resolution":{"observed_at":"2026-05-13T02:42:08.281269Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-03T20:35:31.539481Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:f78d2256db8fc39391ea8e2b3c4e7617a28d11c10c709690a3db572cd956d9f8","observation_id":"33fa20fe-e4d6-4a0c-9437-fd6e14566f71","resolution":{"observed_at":"2026-05-13T02:42:08.256552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.08753","doi":"10.48550/arxiv.2509.08753","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Streaming sequence-to-sequence learning with delayed streams modeling","venue":"ArXiv.org","work_id":"dbaff3a5-4fa6-4137-9291-760d1a435ec6","year":2025},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:d372282baab5baa5dcc59df1845cb83d41299e8bb5588d8f1e09c95ca643eda9","observation_id":"9ffbe4ae-6f79-4c83-aa28-2e91d2073f44","resolution":{"observed_at":"2026-05-13T02:42:08.289130Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We use the utmos22_strong model loaded via torch.hub from tarepan/SpeechMOS:v1.2.0","venue":null,"work_id":"598d7436-2f11-4076-a148-1a8f4bdc5d4f","year":2026},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:1851a06a6692b7950b728276895b8dab4d79a22993775ca4313c3ee588ef256f","observation_id":"ca33e5d4-9b3d-4edb-ae14-df30f83c985b","resolution":{"observed_at":"2026-05-13T12:52:46.463087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":11,"verified_fuzzy":1},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2605.11192."}