{"as_of":"2026-08-08T05:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f93317215b347d279a02a68245323940b947e421e68baa369944e2bb4d068f5c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:53:16.516851Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T19:03:52.201267Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":"2407.08551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-06-29T19:03:52.201267Z","title":"Autoregressive speech synthesis without vector quantization","venue":null,"work_id":"575d89b8-5e74-44f6-819c-38e6e0c52a9f","year":2024},"citing_paper":{"arxiv_id":"2410.06885","last_updated":"2025-05-20T15:53:10Z","snapshot_observed_at":"2026-08-01T23:52:25.071174Z","submitted_at":"2024-10-09T13:46:34Z","title":"F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching","version":3},"reference_index":126,"source":"arxiv_source","source_observed_at":"2026-05-16T06:06:41.348728Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2410.06885"},"observation_digest":"sha256:5d7e845200c221938c32881688376be42ff91fce436102c2f62222e09e64f62b","observation_id":"e06e1dfd-3074-4fde-a7d2-ea6c240bb9b7","resolution":{"observed_at":"2026-05-16T06:06:41.468405Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":"2407.08551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-06-29T19:03:52.201267Z","title":"Autoregressive speech synthesis without vector quantization","venue":null,"work_id":"575d89b8-5e74-44f6-819c-38e6e0c52a9f","year":2024},"citing_paper":{"arxiv_id":"2412.10117","last_updated":"2024-12-25T11:54:03Z","snapshot_observed_at":"2026-08-07T06:02:40.568271Z","submitted_at":"2024-12-13T12:59:39Z","title":"CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T06:19:09.507440Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2412.10117"},"observation_digest":"sha256:f7035637ada2b959ecaee5b076847a5411ac4e669073936a1811e0995d782c43","observation_id":"fe884eda-197b-41f7-84c3-fb53e7e2a702","resolution":{"observed_at":"2026-05-13T06:19:09.555706Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-08-07T14:53:16.516851Z","title":"Autoregressive speech synthesis without vector quanti- zation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17426","last_updated":"2025-05-23T03:13:46Z","snapshot_observed_at":"2026-08-08T01:56:34.167573Z","submitted_at":"2025-05-23T03:13:46Z","title":"UniTTS: An end-to-end TTS system without decoupling of acoustic and semantic information","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.516851Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2505.17426"},"observation_digest":"sha256:f36c4ddf2d8815f793c2c060b5d25fed00a36fb8c8b109ce94e43cb903fa8daa","observation_id":"10d591a9-3c72-4840-b415-418f7995e5cd","resolution":{"observed_at":"2026-08-07T14:53:16.516851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":"2407.08551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-06-29T19:03:52.201267Z","title":"Autoregressive speech synthesis without vector quantization","venue":null,"work_id":"575d89b8-5e74-44f6-819c-38e6e0c52a9f","year":2024},"citing_paper":{"arxiv_id":"2505.17589","last_updated":"2025-05-27T07:48:34Z","snapshot_observed_at":"2026-07-06T21:29:06.781083Z","submitted_at":"2025-05-23T07:55:21Z","title":"CosyVoice 3: Towards In-the-wild Speech Generation via Scaling-up and Post-training","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T05:27:25.425188Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2505.17589"},"observation_digest":"sha256:acf223f0458d7515bb8a97efc5834be6166613e0b237718c1a92badb522f2820","observation_id":"d5037e5d-61a5-4452-ab2d-4960f05112b7","resolution":{"observed_at":"2026-05-16T05:27:25.511402Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-08-07T14:15:53.849366Z","title":"Autoregressive speech synthesis without vector quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19595","last_updated":"2025-05-30T16:52:09Z","snapshot_observed_at":"2026-08-07T14:09:00.316829Z","submitted_at":"2025-05-26T07:07:16Z","title":"Accelerating Diffusion-based Text-to-Speech Model Training with Dual Modality Alignment","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:53.849366Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2505.19595"},"observation_digest":"sha256:a973205a9677b978df6ae03f7df3431d9f2e288b7e53143f59231860e284bcc7","observation_id":"94639417-d75f-4193-b59b-dd326c03cc02","resolution":{"observed_at":"2026-08-07T14:15:53.849366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-08-07T14:15:55.347789Z","title":"Autoregressive speech synthesis without vector quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19669","last_updated":"2025-06-02T10:03:25Z","snapshot_observed_at":"2026-08-07T14:06:47.459513Z","submitted_at":"2025-05-26T08:25:01Z","title":"Zero-Shot Streaming Text to Speech Synthesis with Transducer and Auto-Regressive Modeling","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:55.347789Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2505.19669"},"observation_digest":"sha256:d7ac44d0d2105043d37974ad9b89abe01e86ce26bd2cd3affe1b2bbfbc4e84b1","observation_id":"d5d276c2-d1f9-4b0d-b676-8d33a54b07dd","resolution":{"observed_at":"2026-08-07T14:15:55.347789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-08-07T14:09:18.989987Z","title":"Autoregressive speech synthesis without vector quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19931","last_updated":"2025-06-04T11:58:27Z","snapshot_observed_at":"2026-08-07T14:01:21.072790Z","submitted_at":"2025-05-26T12:58:27Z","title":"Accelerating Flow-Matching-Based Text-to-Speech via Empirically Pruned Step Sampling","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:18.989987Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2505.19931"},"observation_digest":"sha256:59aca9123f5fd957bd507b6c53a5813248ac50e13f9acd20ea9000372fe4f7db","observation_id":"684f42d8-25fd-44d4-bc51-97933e6dced9","resolution":{"observed_at":"2026-08-07T14:09:18.989987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-08-06T17:52:01.354517Z","title":"Autoregressive speech synthesis without vector quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09834","last_updated":"2025-07-14T00:14:54Z","snapshot_observed_at":"2026-08-06T17:43:59.099462Z","submitted_at":"2025-07-14T00:14:54Z","title":"Generative Audio Language Modeling with Continuous-valued Tokens and Masked Next-Token Prediction","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T17:52:01.354517Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2507.09834"},"observation_digest":"sha256:672709e59d68fc3d13633c05f05a885c82bddaecdea9b9398f2eddfad9add649","observation_id":"a6d23f78-8a35-4503-ad35-76443289acc7","resolution":{"observed_at":"2026-08-06T17:52:01.354517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-08-06T17:46:16.401709Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10109","last_updated":"2025-07-14T09:50:53Z","snapshot_observed_at":"2026-08-08T02:46:03.641224Z","submitted_at":"2025-07-14T09:50:53Z","title":"DualDub: Video-to-Soundtrack Generation via Joint Speech and Background Audio Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:46:16.401709Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2507.10109"},"observation_digest":"sha256:ec24b6d4b85caa62a5b3f37eb7347f6249fe3f6b2119fd7497fea9788f43a2f1","observation_id":"e3194c8a-04cd-421e-adef-e2557f37f3b6","resolution":{"observed_at":"2026-08-06T17:46:16.401709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-08-06T11:22:26.796662Z","title":"Autoregressive speech synthesis without vector quantization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22746","last_updated":"2025-08-01T03:37:42Z","snapshot_observed_at":"2026-08-06T13:36:59.117683Z","submitted_at":"2025-07-30T15:03:36Z","title":"Next Tokens Denoising for Speech Synthesis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:22:26.796662Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2507.22746"},"observation_digest":"sha256:af93b3951d96d54f306672f2ba2c58925b150d6a3e5562cb8ad9772dc6b917b2","observation_id":"d3549354-974d-4d53-b100-5142f17f4f53","resolution":{"observed_at":"2026-08-06T11:22:26.796662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-08-05T16:01:52.712652Z","title":"Autoregressive speech synthesis without vector quantization, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19098","last_updated":"2025-08-26T14:59:30Z","snapshot_observed_at":"2026-08-06T21:25:08.912503Z","submitted_at":"2025-08-26T14:59:30Z","title":"CLEAR: Continuous Latent Autoregressive Modeling for High-quality and Low-latency Speech Synthesis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T16:01:52.712652Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2508.19098"},"observation_digest":"sha256:06e7ffb5b710834909cb78bb73186e75968c1236ca639b396ec0549f1f8e17be","observation_id":"95e71bba-b9f8-4aa8-9666-b8f109020006","resolution":{"observed_at":"2026-08-05T16:01:52.712652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-08-04T11:29:34.568989Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04593","last_updated":"2026-06-08T05:49:30Z","snapshot_observed_at":"2026-08-06T08:55:28.794308Z","submitted_at":"2025-10-06T08:47:38Z","title":"UniVoice: Unifying Autoregressive ASR and Flow-Matching based TTS with Large Language Models","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T11:29:34.568989Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2510.04593"},"observation_digest":"sha256:eeb37da58c204fe7dd4525fdaa50b6c30d15f1e9b3a30888d376bd3f988adce8","observation_id":"53c9b8f7-de86-422e-b20a-8907cae3e636","resolution":{"observed_at":"2026-08-04T11:29:34.568989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":"2407.08551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-06-29T19:03:52.201267Z","title":"Autoregressive speech synthesis without vector quantization","venue":null,"work_id":"575d89b8-5e74-44f6-819c-38e6e0c52a9f","year":2024},"citing_paper":{"arxiv_id":"2604.06327","last_updated":"2026-04-07T18:05:28Z","snapshot_observed_at":"2026-07-06T22:54:48.916799Z","submitted_at":"2026-04-07T18:05:28Z","title":"A Novel Automatic Framework for Speaker Drift Detection in Synthesized Speech","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T18:24:54.627215Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2604.06327"},"observation_digest":"sha256:f1e8ab278c6f0e667602c8761312173bd8e077d43f0e2c3ec29026de9d24a2c6","observation_id":"01e303e7-327f-4ccc-b7b8-3fd43a3ccb9b","resolution":{"observed_at":"2026-05-11T00:41:00.891180Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization","version":2},"cited_work":{"arxiv_id":"2407.08551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08551","snapshot_observed_at":"2026-06-29T19:03:52.201267Z","title":"Autoregressive speech synthesis without vector quantization","venue":null,"work_id":"575d89b8-5e74-44f6-819c-38e6e0c52a9f","year":2024},"citing_paper":{"arxiv_id":"2606.27978","last_updated":"2026-06-26T11:27:39Z","snapshot_observed_at":"2026-08-03T23:56:14.294002Z","submitted_at":"2026-06-26T11:27:39Z","title":"Parallel Rollout Approximation for Pixel-Space Autoregressive Image Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T04:58:23.066578Z"},"links":{"cited_paper":"/paper/2407.08551","citing_paper":"/paper/2606.27978"},"observation_digest":"sha256:78870defe628f478dfe42471ed03117d25d28fa1d6b236c168ff5e1b838cd3a4","observation_id":"c13c7250-02ea-497c-8330-040c204792c9","resolution":{"observed_at":"2026-06-29T19:03:52.202816Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2407.08551/citation-record","integrity":"/paper/2407.08551/integrity","json":"/paper/2407.08551/citation-record.json","paper":"/paper/2407.08551"},"outbound":[],"paper":{"arxiv_id":"2407.08551","last_updated":"2025-05-27T05:07:56Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-05T05:08:56.833881Z","submitted_at":"2024-07-11T14:36:53Z","title":"Autoregressive Speech Synthesis without Vector Quantization"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2407.08551."}