{"as_of":"2026-08-11T05:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6ecca78c49b07e22adf0e82f6f785e281fc9661f86de8ee5459dbd3bd01a07ef","coverage":[{"denominator":159,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:20:42.062629Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07462/citation-record","integrity":"/paper/2608.07462/integrity","json":"/paper/2608.07462/citation-record.json","paper":"/paper/2608.07462"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.607812Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.607812Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:647f90d16d49dd180f390dc7d95fa98148a840bce9c52b7c07806d9e67e77021","observation_id":"ba358eea-916f-4109-8aae-5798675dca3d","resolution":{"observed_at":"2026-08-10T04:20:41.607812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.612592Z","title":"Kingma and Max Welling , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.612592Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:e959905a194abba474b6e04142816631d64d22871d8a22769a52c09e0e87389d","observation_id":"85e75195-95c8-41bb-969b-c7cea62047f1","resolution":{"observed_at":"2026-08-10T04:20:41.612592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.616911Z","title":"International Conference on Learning Representations , publisher =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.616911Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:ef12b69ed4603a635db7eb79c20202beb05cb81956114b98f37695c8fe623b55","observation_id":"cf0a7bd2-a96f-4518-b892-3915166cce70","resolution":{"observed_at":"2026-08-10T04:20:41.616911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.621248Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.621248Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:f3e65caab523a6e20ce0e5bc238588b08948e216095ef255e1f5c64a19db4cfc","observation_id":"476379a9-0374-4f9a-ac39-e0ea2e92240b","resolution":{"observed_at":"2026-08-10T04:20:41.621248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-10T04:20:41.625624Z","title":"Moshi: a speech-text foundation model for real-time dialogue , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.625624Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:b60dee6231ea268a59f67fdab6df0d776e3eb3542f297b3ed16d9fe911450f05","observation_id":"04bf4026-8ecc-4733-aba5-036abb9da68e","resolution":{"observed_at":"2026-08-10T04:20:41.625624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.630402Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.630402Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:c8006b0dba2df483baa72dfc51c51b1f05a0806b286a8cf4fb335502ec91708d","observation_id":"259be002-b69e-49ad-8848-99f31acb9573","resolution":{"observed_at":"2026-08-10T04:20:41.630402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.635654Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.635654Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:5c88c2fd7054f88d671c0b51bfc10383bdff9be0f8415c6384811d155003f309","observation_id":"d373439e-7900-4f6c-877d-583ff642536e","resolution":{"observed_at":"2026-08-10T04:20:41.635654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.640284Z","title":"International Conference on Learning Representations , publisher =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.640284Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:f3c0a56e3b90857a817a08d9628ac7a43cce77befbaf7dd1a22b5719fb1c7a73","observation_id":"35f03f85-f761-4877-b61e-7e8261371621","resolution":{"observed_at":"2026-08-10T04:20:41.640284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2512.04779","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"arXiv preprint arXiv:2512.04779 , year =","venue":"ArXiv.org","work_id":"ec001e35-bba8-429b-a769-b7cbc8911f02","year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.644600Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:ef29f2ce76abd85e057927756037e4b410057c4341ea10aedb4e266c78676713","observation_id":"14647de4-3e53-4dba-98e4-05ccd35fd236","resolution":{"observed_at":"2026-08-10T04:20:44.510983Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.648909Z","title":"Rix and John G","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.648909Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:7263a79bd39a636565142fc04e6d5d81ec46b8530e2eb406f25eaa2b4fd55175","observation_id":"5400c6b8-541b-4674-8708-019f44f0ffd6","resolution":{"observed_at":"2026-08-10T04:20:41.648909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.653363Z","title":"Taal and Richard C","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.653363Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:12317780b4f6a56031fe58f940dfd1b08e74f068a9ac1ecf4a58d192ffe478b3","observation_id":"53815f74-2c1d-45c0-aace-21f97314502b","resolution":{"observed_at":"2026-08-10T04:20:41.653363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.06928","last_updated":"2026-06-05T05:43:15Z","snapshot_observed_at":"2026-07-06T23:46:37.903443Z","submitted_at":"2026-06-05T05:43:15Z","title":"VoxCPM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.06928","snapshot_observed_at":"2026-08-10T04:20:41.657447Z","title":"arXiv preprint arXiv:2606.06928 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.657447Z"},"links":{"cited_paper":"/paper/2606.06928","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:f054317f21f9b5a2fbe5726a5a07e08bbc5574c2aa5a65288a158fd2eca1b697","observation_id":"0768146a-2083-4915-9672-fed47dc05175","resolution":{"observed_at":"2026-08-10T04:20:41.657447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2512.19090","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"arXiv preprint arXiv:2512.19090 , year =","venue":"arXiv (Cornell University)","work_id":"fc2846eb-7b41-4322-8f6c-399d0c46c4fd","year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.662778Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:6f378f981e3e4ab645ee3547ec03fabaff132c38bf5307382d2033cfc604f5d8","observation_id":"8b70e063-9e69-45af-b850-917bbde9b0d7","resolution":{"observed_at":"2026-08-10T04:20:44.418907Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.668438Z","title":"IEEE Journal of Selected Topics in Signal Processing , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.668438Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:8b846c346b43636c6b4b01054db554c2f0f7d82e6db5d5792339b36874774f67","observation_id":"0f4eb67d-4eb0-4cdc-8cf4-3bcaf6d30d44","resolution":{"observed_at":"2026-08-10T04:20:41.668438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.673221Z","title":"Proceedings of Interspeech , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.673221Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:e25d26f9c5c10820b27dfa79d1b0d01fbb425a2aafb0a4ffc5790e2742ee4711","observation_id":"3135a047-2719-49b8-bd13-787adc3a82f6","resolution":{"observed_at":"2026-08-10T04:20:41.673221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.678009Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.678009Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:973ca987607b510499a44b2a100717c43a9bcbf6c9b1ad9fabaf26b5f6b9aec1","observation_id":"0fcf45cd-29e8-4660-8456-8a4a9bab6378","resolution":{"observed_at":"2026-08-10T04:20:41.678009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.683086Z","title":"arXiv preprint arXiv:2509.24650 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.683086Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:20eeea46bebdee3c05a988750ffd7418529f9d2c2346f103a2de7db1826ffd56","observation_id":"4f0df980-b426-42ad-8ba3-47cfbe249939","resolution":{"observed_at":"2026-08-10T04:20:41.683086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.16964","last_updated":"2026-05-16T12:37:06Z","snapshot_observed_at":"2026-08-02T05:10:05.598125Z","submitted_at":"2026-05-16T12:37:06Z","title":"SemaVoice: Semantic-Aware Continuous Autoregressive Speech Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.16964","snapshot_observed_at":"2026-08-10T04:20:41.688976Z","title":"arXiv preprint arXiv:2605.16964 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.688976Z"},"links":{"cited_paper":"/paper/2605.16964","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:2d5079625a9ef7cf7a67ad8a63b2da62f72923aeb471394539dcf56ac3fb3073","observation_id":"732ccaba-0da1-4d4d-b7e6-562e94443592","resolution":{"observed_at":"2026-08-10T04:20:41.688976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02612","last_updated":"2024-12-03T17:41:24Z","snapshot_observed_at":"2026-08-02T21:27:26.884251Z","submitted_at":"2024-12-03T17:41:24Z","title":"GLM-4-Voice: Towards Intelligent and Human-Like End-to-End Spoken Chatbot","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02612","snapshot_observed_at":"2026-08-10T04:20:41.694183Z","title":"arXiv preprint arXiv:2412.02612 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.694183Z"},"links":{"cited_paper":"/paper/2412.02612","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:0279d1de8a98deee133985ccee9a71aff3bfffb8cc9c2c5df8039e99cc63ed2f","observation_id":"10adce2e-e654-40fc-9766-7909b25b3abd","resolution":{"observed_at":"2026-08-10T04:20:41.694183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03143","last_updated":"2023-07-26T03:52:36Z","snapshot_observed_at":"2026-08-02T01:30:06.675966Z","submitted_at":"2022-09-07T13:40:08Z","title":"AudioLM: a Language Modeling Approach to Audio Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03143","snapshot_observed_at":"2026-08-10T04:20:41.699270Z","title":"arXiv preprint arXiv:2209.03143 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.699270Z"},"links":{"cited_paper":"/paper/2209.03143","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:6044ac2f9211e3b9fbe2196566c5a6deccd8ee6ed6e121871c57e48a31712915","observation_id":"447b15b7-b18c-41c8-8176-c7d6029efbc9","resolution":{"observed_at":"2026-08-10T04:20:41.699270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-07T10:11:17.796562Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-10T04:20:41.704038Z","title":"arXiv preprint arXiv:2301.02111 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.704038Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:15d1ba28ea43efdcf0b52e025855d999a4ea0993536484a38de2dae8d922e5d8","observation_id":"6091dd6b-522a-4a88-a7d7-c79545298e58","resolution":{"observed_at":"2026-08-10T04:20:41.704038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09636","last_updated":"2023-05-16T17:41:25Z","snapshot_observed_at":"2026-08-06T19:45:49.830925Z","submitted_at":"2023-05-16T17:41:25Z","title":"SoundStorm: Efficient Parallel Audio Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09636","snapshot_observed_at":"2026-08-10T04:20:41.708999Z","title":"arXiv preprint arXiv:2305.09636 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.708999Z"},"links":{"cited_paper":"/paper/2305.09636","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:b407162ba0122de91ac8c90a90c489a8e9fb4de5b1cc70f3410a5e17af0efde9","observation_id":"9bc3b870-af81-4e95-a701-506d9bfef7e8","resolution":{"observed_at":"2026-08-10T04:20:41.708999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.713507Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.713507Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:a4fe5a886aa3eb086a8f94c26e7557c95eb45d17cbd26e1f65777ecca78f8c75","observation_id":"b7af4482-4653-421c-a1c2-dd36918cf020","resolution":{"observed_at":"2026-08-10T04:20:41.713507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.717355Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.717355Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:af2b58dc1e69890e2aad95de430a660e6fed617ad32312d7a00befdd565d8b12","observation_id":"20bdddc9-1acd-4bb5-bbcd-515e8e270a2a","resolution":{"observed_at":"2026-08-10T04:20:41.717355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.721268Z","title":"Proceedings of the IEEE Spoken Language Technology Workshop , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.721268Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:cec682d8c30e18f06788bb3af9620e71deed5d5c7d5c6f8fa9a7b7e750c3b8b7","observation_id":"0416556d-d089-494a-b82e-a3be73a33ed0","resolution":{"observed_at":"2026-08-10T04:20:41.721268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.725410Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.725410Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:5398d841692247d7fd3a5249242d61791517d1bd81e66a84a9ef2f7cc9f7a38b","observation_id":"8b760eb5-c396-432f-8c58-13234ae9210b","resolution":{"observed_at":"2026-08-10T04:20:41.725410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.729160Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.729160Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:b9947c6fa99dbf8860830d2192755887ae36d766ceb417781b7c5951808aa6b3","observation_id":"7974eeaa-23af-4de9-bb43-200b535034d0","resolution":{"observed_at":"2026-08-10T04:20:41.729160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.733220Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.733220Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:57f341a588d5bb14aa33fc759bc4a075c1b22d99abe3e10831dc6128e5e74aa7","observation_id":"704514fd-7667-4250-895f-b132622dd437","resolution":{"observed_at":"2026-08-10T04:20:41.733220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.741307Z","title":"Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.741307Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:38c675f98e05a2018984f86f042c69922854acd34c777c7c19a5034d30bbec85","observation_id":"9edd6fdb-e459-4e89-86a2-cfe7bc22c703","resolution":{"observed_at":"2026-08-10T04:20:41.741307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06027","last_updated":"2026-07-15T09:47:05Z","snapshot_observed_at":"2026-08-08T09:38:50.540319Z","submitted_at":"2026-07-07T09:07:30Z","title":"Fr\\'echet Distance Loss on Speech Representations for Text-to-Speech Synthesis","version":3},"cited_work":{"arxiv_id":"2607.06027","doi":"10.48550/arxiv.2607.06027","metadata_source":"pith","pith_arxiv_id":"2607.06027","snapshot_observed_at":"2026-08-10T06:16:20.510975Z","title":"Fr\\'echet Distance Loss on Speech Representations for Text-to-Speech Synthesis","venue":"cs.SD","work_id":"241f28fc-f8c5-4e59-9a65-d0b824e30c68","year":2026},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.745278Z"},"links":{"cited_paper":"/paper/2607.06027","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:9d7bd9146a95daa7f72cb92afaac47c6edc5a2dba712678f06c185f537a348d5","observation_id":"94094ee4-4b67-43ea-898b-9dca083401b6","resolution":{"observed_at":"2026-08-10T04:20:44.195252Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02430","last_updated":"2024-06-04T15:48:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T15:48:29Z","title":"Seed-TTS: A Family of High-Quality Versatile Speech Generation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02430","snapshot_observed_at":"2026-08-10T04:20:41.749694Z","title":"arXiv preprint arXiv:2406.02430 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.749694Z"},"links":{"cited_paper":"/paper/2406.02430","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:2765b555631322cded2758ef713033b74504fb2bd65f372f20fb70c1c0e37067","observation_id":"c8bf90b7-76f6-4da1-829e-6abc42603dd5","resolution":{"observed_at":"2026-08-10T04:20:41.749694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.754830Z","title":"Proceedings of the International Conference on Machine Learning , series =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.754830Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:0d4ae6e4ee703c4a69941ce45111e4e2e4fba07dcf3926e230efc499519f9d9f","observation_id":"b6aac4f0-df43-4b43-a1a0-c1837355d713","resolution":{"observed_at":"2026-08-10T04:20:41.754830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.759311Z","title":"Meng and Furu Wei , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.759311Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:f41ea3f76ae36a9b9f81d2cf8caa0dfc6292a3fc8e29d3fe326e366c949e05a1","observation_id":"d801be8a-b4c0-4767-94b1-55bb2c897ff4","resolution":{"observed_at":"2026-08-10T04:20:41.759311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17589","last_updated":"2025-05-27T07:48:34Z","snapshot_observed_at":"2026-08-08T16:08:45.949013Z","submitted_at":"2025-05-23T07:55:21Z","title":"CosyVoice 3: Towards In-the-wild Speech Generation via Scaling-up and Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17589","snapshot_observed_at":"2026-08-10T04:20:41.764049Z","title":"arXiv preprint arXiv:2505.17589 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.764049Z"},"links":{"cited_paper":"/paper/2505.17589","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:d0cbeaf72ff7fba9029ea4b8ab4e982cd441af5c4a7e154183f448dd4ebed7ce","observation_id":"28e59f5f-47ab-45a9-8662-0ac4c7c1c48e","resolution":{"observed_at":"2026-08-10T04:20:41.764049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2602.07803","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"arXiv preprint arXiv:2602.07803 , year =","venue":"Open MIND","work_id":"dc63efae-b03e-452e-be8f-958acfd51bb6","year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.769005Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:23e51f6bb5d721902fad6091f2ee4c9742d382202e77645044121cf0e044436c","observation_id":"3685961a-c3d0-4762-9e38-079b7bcc3fb9","resolution":{"observed_at":"2026-08-10T04:20:44.139470Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.773509Z","title":"Proceedings of Interspeech , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.773509Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:2fdd03960da5bf356dcb2d2e5c1956897e44cfdc12c5fce8602178a67da7401f","observation_id":"ea102c6a-157f-48cf-a731-f88f2ba21833","resolution":{"observed_at":"2026-08-10T04:20:41.773509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.777985Z","title":"Proceedings of the International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.777985Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:069ac12932b74233c869a1f782c1a53f004ed6a618256a529990bf5d643e53b4","observation_id":"bb8d17dd-0e9a-458d-bce5-1e629ac67e4c","resolution":{"observed_at":"2026-08-10T04:20:41.777985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.782926Z","title":"IEEE Journal of Selected Topics in Signal Processing , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.782926Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:6a102195b10c5ededa5b06e0633ce8c5ef039b5fa04ea1ab3c06e41686d6d3ce","observation_id":"cc0a886f-cce3-4ae8-8ac5-3df278f38b78","resolution":{"observed_at":"2026-08-10T04:20:41.782926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2510.01812","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:44.047815Z","title":"arXiv preprint arXiv:2510.01812 , year =","venue":null,"work_id":"d5ba7fd7-ccdc-403d-9d37-002ba6426212","year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.787254Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:a89e4246aba6c30f8daec90680ff70c7868b423aa80ff09fbb4b260611ac15d7","observation_id":"05edd70e-8d9c-4251-b2d7-9303e397044f","resolution":{"observed_at":"2026-08-10T04:20:44.052712Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.792381Z","title":"IEEE Transactions on Audio, Speech and Language Processing , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.792381Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:343476389707e7d43e8ecaeba100f0ee3ff766d9588a3a1d8c7cb6b88bbc1057","observation_id":"b8716a3a-c024-4ce7-930b-19e62c7d2403","resolution":{"observed_at":"2026-08-10T04:20:41.792381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.796710Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.796710Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:2cb17f5c7bec60e846897456c2d5dca88a76ed1066d65a68b83a60131100470d","observation_id":"a65d4335-3964-4efa-a625-433368663d6e","resolution":{"observed_at":"2026-08-10T04:20:41.796710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.801498Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.801498Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:acb6bf2e869c6ccef698c52e935de3aabae3f2dc57a90e7f8f6bae5989861010","observation_id":"c3338d76-bbfc-4ec8-89a4-8efe52844659","resolution":{"observed_at":"2026-08-10T04:20:41.801498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.806025Z","title":"Proceedings of Interspeech , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.806025Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:1d670d820ae255a4caf33f0122c07610b1efe13eeaa09c1d139b7cc964893827","observation_id":"27586323-ce22-41c3-9165-5071eaf5c0db","resolution":{"observed_at":"2026-08-10T04:20:41.806025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.810244Z","title":"Proceedings of the International Conference on Machine Learning , series =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.810244Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:314affb016bd9844cf67cd7d10d2e0027454e4ef3fe7f0519bc67211db3c1512","observation_id":"0474fb10-223a-4fb9-aa93-3db2c398b8d4","resolution":{"observed_at":"2026-08-10T04:20:41.810244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.814230Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.814230Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:9d3ed100f96d5efc5383d897999c0a6e418c0d1a23b1a9dac344f5767e6687a5","observation_id":"4517d1bb-1f72-481b-9f97-603b32dc97f5","resolution":{"observed_at":"2026-08-10T04:20:41.814230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.818342Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.818342Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:a08efebecf74c25be2ce7f803e7c70b3b9a99653151b59a25876bdf92d4df200","observation_id":"3e0fce71-3cd2-4dd0-8ce1-7aa974e65751","resolution":{"observed_at":"2026-08-10T04:20:41.818342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.822213Z","title":"Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.822213Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:8820302e7a12248637c5f821ac588f9e5e77d5cc05dcfc20bb02d438b769e192","observation_id":"23111cbe-8bb7-4fc4-a0df-9836bfc195d5","resolution":{"observed_at":"2026-08-10T04:20:41.822213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.826286Z","title":"arXiv preprint arXiv:2601.03888 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.826286Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:2d298a56f786c418711d8dad6e95a3107a093afd100f5e8a5f744f49e6955ea0","observation_id":"32dc72dd-816f-452b-a620-cc586dce0efa","resolution":{"observed_at":"2026-08-10T04:20:41.826286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.830713Z","title":"Zico Kolter and Kaiming He , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.830713Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:f86c58424bf58421c7010259f37837c79be86304b10f9131695690b2c35814e1","observation_id":"e9af1aac-3865-4345-b001-0c1262d728dc","resolution":{"observed_at":"2026-08-10T04:20:41.830713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06262","last_updated":"2025-08-08T12:28:34Z","snapshot_observed_at":"2026-08-05T22:50:20.992547Z","submitted_at":"2025-08-08T12:28:34Z","title":"Llasa+: Free Lunch for Accelerated and Streaming Llama-Based Speech Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.06262","snapshot_observed_at":"2026-08-10T04:20:41.834908Z","title":"arXiv preprint arXiv:2508.06262 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.834908Z"},"links":{"cited_paper":"/paper/2508.06262","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:cd66e6953e6b0eea8312e01f58e7fb7875608fccea7a6a58d218eb04279a9046","observation_id":"1ee85f49-bf5e-457c-a3b8-3d0bdd5aa281","resolution":{"observed_at":"2026-08-10T04:20:41.834908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.839489Z","title":"Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.839489Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:899bea6a0a5099c3e838e4400f44acc117c273001da49910e7e9543147bc56ee","observation_id":"335b64bc-6644-4bda-b717-d75af0b8f719","resolution":{"observed_at":"2026-08-10T04:20:41.839489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.843551Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.843551Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:8e7f90c3a673de2eff63eea0d61a90df97ffa307873a181fc5085bdb5e75277b","observation_id":"b36ca01c-3e9f-47a1-9feb-245522a5c5c9","resolution":{"observed_at":"2026-08-10T04:20:41.843551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.847737Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.847737Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:c4010aa9a3ad19e3ba910aeb16ae56b4e6aeb3d902cd136f66041a76a4a86de0","observation_id":"2eecd531-20c3-413f-ab0d-30e561aba043","resolution":{"observed_at":"2026-08-10T04:20:41.847737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.13720","last_updated":"2026-01-07T05:36:57Z","snapshot_observed_at":"2026-07-06T22:36:08.495952Z","submitted_at":"2025-11-17T18:59:57Z","title":"Back to Basics: Let Denoising Generative Models Denoise","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.13720","snapshot_observed_at":"2026-08-10T04:20:41.851952Z","title":"arXiv preprint arXiv:2511.13720 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.851952Z"},"links":{"cited_paper":"/paper/2511.13720","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:e457d82b9c443b62dcbd77f2d799419e8f8f3da5099416cbf45b0f41eebe1094","observation_id":"6b0780a2-604c-43ef-a2c5-b79742dad459","resolution":{"observed_at":"2026-08-10T04:20:41.851952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-10T04:20:41.856584Z","title":"arXiv preprint arXiv:2412.15115 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.856584Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:965337ba1ba0e439d1f5d2dde9c7b49f1be8d7f2ea26835d5230600fc7b8f91e","observation_id":"4cafcbbe-1224-4ed1-8fb4-5373827411ee","resolution":{"observed_at":"2026-08-10T04:20:41.856584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.861421Z","title":"Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.861421Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:d97e9e571b9161246c417cf2e2a558f08a45f10968a9f2007b4f1624b76f6b43","observation_id":"ac547897-1862-4781-a091-361629de033f","resolution":{"observed_at":"2026-08-10T04:20:41.861421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.865774Z","title":"Proceedings of the IEEE Spoken Language Technology Workshop , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.865774Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:8baf79c4aa155ee9d396c8f97d7646bd35b0b5dbcaa11a644803bfffa044dac6","observation_id":"dd0f84c6-e04f-4877-b037-04be6999a65b","resolution":{"observed_at":"2026-08-10T04:20:41.865774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05763","last_updated":"2024-06-19T04:52:56Z","snapshot_observed_at":"2026-07-06T18:27:45.631190Z","submitted_at":"2024-06-09T12:32:42Z","title":"WenetSpeech4TTS: A 12,800-hour Mandarin TTS Corpus for Large Speech Generation Model Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05763","snapshot_observed_at":"2026-08-10T04:20:41.870923Z","title":"arXiv preprint arXiv:2406.05763 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.870923Z"},"links":{"cited_paper":"/paper/2406.05763","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:f8fa9bcf95e91bf849f9d50db94326f9690412c3cc6f7bae31ed4f1d9750ecb2","observation_id":"c48be3ba-81f7-48be-9750-925325d18207","resolution":{"observed_at":"2026-08-10T04:20:41.870923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01156","last_updated":"2024-11-09T05:58:10Z","snapshot_observed_at":"2026-08-10T00:08:15.031162Z","submitted_at":"2024-11-02T07:04:02Z","title":"Fish-Speech: Leveraging Large Language Models for Advanced Multilingual Text-to-Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01156","snapshot_observed_at":"2026-08-10T04:20:41.875811Z","title":"arXiv preprint arXiv:2411.01156 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.875811Z"},"links":{"cited_paper":"/paper/2411.01156","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:c4265c126fdb43457cea19bd2d000ed9f3c1aa57b2cacbbaf85d45951d388d1a","observation_id":"58f07b94-66e8-42f0-970a-a83355966612","resolution":{"observed_at":"2026-08-10T04:20:41.875811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2512.20151","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"arXiv preprint arXiv:2512.20151 , year =","venue":"arXiv (Cornell University)","work_id":"48c1fc6a-5b05-4d69-99fc-ebde6ccc564b","year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.881312Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:4e622a7949bdcd2f4190ae08fbd6ce921278c2f52ac9e12c7bd53260a49b0b10","observation_id":"77b95cc7-23fa-4dc3-acb8-c7e305c5173f","resolution":{"observed_at":"2026-08-10T04:20:43.799702Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.886223Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.886223Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:c2713cf54a0372383dfa2aead59e8f7623add97748ff2ff38bd246b083705639","observation_id":"b3e2a2ec-5a85-49eb-bfa4-983da951d61e","resolution":{"observed_at":"2026-08-10T04:20:41.886223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.890980Z","title":"Speak, read and prompt: High-fidelity text-to-speech with minimal supervision , journal =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.890980Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:7604bb6a33174fb9ac45071688be22cecbd77ac0b018ae92ad544cfa5c44a9d8","observation_id":"8c3e0a89-c707-4f8e-b716-5332dd8e7d20","resolution":{"observed_at":"2026-08-10T04:20:41.890980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2512.14291","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"arXiv preprint arXiv:2512.14291 , year =","venue":"ArXiv.org","work_id":"0f9539a8-ca77-4497-a465-dcde94a4bf3d","year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.895454Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:c8c281f775730da77537cb53e7ea6996b3aba6b9f9be245b8e6024cf52a90951","observation_id":"b19dda39-3b5a-4cb6-9639-6633486c1c43","resolution":{"observed_at":"2026-08-10T04:20:43.737189Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2510.23541","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"arXiv preprint arXiv:2510.23541 , year =","venue":"arXiv (Cornell University)","work_id":"7e991867-7f77-4ba5-9c35-383e0a6958d6","year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.900596Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:837b97464e909974612370b2a1a0bf3be62bfa956ba17958ad7db3e4028949b3","observation_id":"6a2badea-05b9-4903-b546-4665d54b82e8","resolution":{"observed_at":"2026-08-10T04:20:43.664660Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.905290Z","title":"arXiv preprint arXiv:2512.18706 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.905290Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:2cecca7bf8121ae62a5b68f448e53a2441422e1515d48ecb729cd26db88e9c54","observation_id":"a6671714-c610-40e2-987b-27d3f2ef0b15","resolution":{"observed_at":"2026-08-10T04:20:41.905290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-08-11T00:14:34.061687Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-08-10T04:20:41.909133Z","title":"arXiv preprint arXiv:2509.17765 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.909133Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:d34cea7bbb52091012a0a80e2ebd375113ea0581a15170709a22c4136fefe878","observation_id":"9917e342-f71f-4d29-b504-0871045f7a32","resolution":{"observed_at":"2026-08-10T04:20:41.909133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15621","last_updated":"2026-01-22T03:51:43Z","snapshot_observed_at":"2026-08-04T12:22:34.670840Z","submitted_at":"2026-01-22T03:51:43Z","title":"Qwen3-TTS Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.15621","snapshot_observed_at":"2026-08-10T04:20:41.914154Z","title":"arXiv preprint arXiv:2601.15621 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.914154Z"},"links":{"cited_paper":"/paper/2601.15621","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:9779df759f1505788151eb39743cb69a2b3330f0e50a0b7217921fae772531dd","observation_id":"6dd294c3-0ea0-4cba-8d54-b18f4aa75ce1","resolution":{"observed_at":"2026-08-10T04:20:41.914154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2510.08392","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:43.497321Z","title":"arXiv preprint arXiv:2510.08392 , year =","venue":null,"work_id":"2833e827-793b-4a12-bb0c-e106b75847b4","year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.918297Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:4dd845aa5fa6d379e4f4f304450acd6f7e903dc75a632e296f9f003734e1c634","observation_id":"ed995659-28f6-414b-a7d3-a03d3528f8ff","resolution":{"observed_at":"2026-08-10T04:20:43.502023Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-10T04:20:41.922423Z","title":"doi:10.48550/arXiv.2412.19437 , eprint =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.922423Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:051b1cb38967711f923e9a40144e1151c037c07c020fe8d1b1ab33ca25a848b3","observation_id":"6a176ab8-d050-4124-9144-a881dd5a5def","resolution":{"observed_at":"2026-08-10T04:20:41.922423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2509.18196","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:43.392173Z","title":"arXiv preprint arXiv:2509.18196 , year =","venue":null,"work_id":"6aa59224-2068-4fe5-bcf1-2bc621832add","year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.926959Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:6bdfb84e2c0cda97e7ba0c75cab52b50bdd730c8db58f24c6112cef1d08fa6c8","observation_id":"f8fdc5df-b336-457b-9465-a30c23145f9e","resolution":{"observed_at":"2026-08-10T04:20:43.398191Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.931378Z","title":"Proceedings of the International Conference on Machine Learning , series =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.931378Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:514958bd18abb720161fc0714d59d7baa06c10489b200828fef9885c42a51382","observation_id":"6581d12e-c6a8-4d0d-8d8c-79865cac186a","resolution":{"observed_at":"2026-08-10T04:20:41.931378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-10T04:20:41.935168Z","title":"arXiv preprint arXiv:2507.06261 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.935168Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:626c4795680ade882e43414e79316e42c466ebf0faa74439b266f4d64715ec9f","observation_id":"a2fda364-a763-450d-a382-7ccb047eeea2","resolution":{"observed_at":"2026-08-10T04:20:41.935168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.939681Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.939681Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:ae946801207e054da4e1b1e07cc5bc47198076c3091c945aa566f1f1f2f50dfe","observation_id":"5cdadee2-e0fd-401e-9881-f995c387a85f","resolution":{"observed_at":"2026-08-10T04:20:41.939681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.944000Z","title":"Proceedings of the International Conference on Machine Learning , series =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.944000Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:5441673b21e33aa5c3e31257a49ec275209a00555c0f5b8fbcef3ebc9d817e66","observation_id":"24b61da2-e6a4-4e53-abfd-b786b7c50877","resolution":{"observed_at":"2026-08-10T04:20:41.944000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-10T04:20:41.948449Z","title":"arXiv preprint arXiv:2509.03959 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.948449Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:8f374be440bbd93cd29519b57778eb1ed6514298c94af9d364a79b2718fda4d5","observation_id":"1ff58e44-608d-40df-9a54-7d5045e7c5b6","resolution":{"observed_at":"2026-08-10T04:20:41.948449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.953245Z","title":"arXiv preprint arXiv:2509.18004 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.953245Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:881f12a9e9e6d0d3638ed9f4e27c54a807293ed66b36a78a670bdd9823223d2c","observation_id":"9a5c75f1-644b-46b8-9a72-1b3c1733ccaa","resolution":{"observed_at":"2026-08-10T04:20:41.953245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10781","last_updated":"2025-03-02T14:37:53Z","snapshot_observed_at":"2026-08-02T20:46:05.666977Z","submitted_at":"2024-10-14T17:50:28Z","title":"When Attention Sink Emerges in Language Models: An Empirical View","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10781","snapshot_observed_at":"2026-08-10T04:20:41.957526Z","title":"arXiv preprint arXiv:2410.10781 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.957526Z"},"links":{"cited_paper":"/paper/2410.10781","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:24ee10df311d83b392c66b85b00344bb1999373a0897f9da8f5c3e623f6e405f","observation_id":"5a1f70fc-82ea-47d8-8baa-823d1f1c2777","resolution":{"observed_at":"2026-08-10T04:20:41.957526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-10T04:20:41.962514Z","title":"arXiv preprint arXiv:2505.09388 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.962514Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:852592541b8b41b1fd2894257496e32010c9b73ea0bdef661a3e25737080d2a2","observation_id":"6dd59182-fea0-4d78-ae6c-f6e5b8581711","resolution":{"observed_at":"2026-08-10T04:20:41.962514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13053","last_updated":"2025-08-07T03:12:26Z","snapshot_observed_at":"2026-08-08T05:07:44.858553Z","submitted_at":"2025-06-16T02:48:17Z","title":"ZipVoice: Fast and High-Quality Zero-Shot Text-to-Speech with Flow Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13053","snapshot_observed_at":"2026-08-10T04:20:41.967244Z","title":"arXiv preprint arXiv:2506.13053 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.967244Z"},"links":{"cited_paper":"/paper/2506.13053","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:5bec3109d38ce502090c345c056ae9b19667464d9c2efde82cefa0fa81c0c4f5","observation_id":"8cdbe7ad-c11e-466b-814e-1739038e6f0b","resolution":{"observed_at":"2026-08-10T04:20:41.967244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09318","last_updated":"2026-04-14T14:21:41Z","snapshot_observed_at":"2026-08-02T11:31:42.381498Z","submitted_at":"2025-07-12T15:18:47Z","title":"ZipVoice-Dialog: Non-Autoregressive Spoken Dialogue Generation with Flow Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.09318","snapshot_observed_at":"2026-08-10T04:20:41.971876Z","title":"arXiv preprint arXiv:2507.09318 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.971876Z"},"links":{"cited_paper":"/paper/2507.09318","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:1d7a0899e480f351e3fc5c1116e48c6df3fe8f3ee0fa2c86cab79ac22cf2e4e2","observation_id":"c2905cda-d7b1-412a-8fc8-068c3d466427","resolution":{"observed_at":"2026-08-10T04:20:41.971876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03283","last_updated":"2025-04-11T07:36:53Z","snapshot_observed_at":"2026-08-10T13:39:10.906314Z","submitted_at":"2024-09-05T06:48:02Z","title":"FireRedTTS: A Foundation Text-To-Speech Framework for Industry-Level Generative Speech Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03283","snapshot_observed_at":"2026-08-10T04:20:41.976517Z","title":"arXiv preprint arXiv:2409.03283 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.976517Z"},"links":{"cited_paper":"/paper/2409.03283","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:41eabbcf7da2874e4bac6073b42d634c7831f995cb8c79633cafaf9a755c4b65","observation_id":"dc857c26-10f2-4ec1-ac65-a2afc4878fa2","resolution":{"observed_at":"2026-08-10T04:20:41.976517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02020","last_updated":"2025-09-04T03:36:39Z","snapshot_observed_at":"2026-08-10T18:31:06.041111Z","submitted_at":"2025-09-02T07:06:46Z","title":"FireRedTTS-2: Towards Long Conversational Speech Generation for Podcast and Chatbot","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02020","snapshot_observed_at":"2026-08-10T04:20:41.980552Z","title":"arXiv preprint arXiv:2509.02020 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.980552Z"},"links":{"cited_paper":"/paper/2509.02020","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:6a6a5371ba7d252cfa22fc2fab08e4e6c77e5615d95f5bbac5e00114d368580a","observation_id":"89fb8f6b-3ee3-48eb-91b6-9efa46182242","resolution":{"observed_at":"2026-08-10T04:20:41.980552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05512","last_updated":"2025-02-08T10:23:20Z","snapshot_observed_at":"2026-08-09T19:41:17.737989Z","submitted_at":"2025-02-08T10:23:20Z","title":"IndexTTS: An Industrial-Level Controllable and Efficient Zero-Shot Text-To-Speech System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05512","snapshot_observed_at":"2026-08-10T04:20:41.984640Z","title":"arXiv preprint arXiv:2502.05512 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.984640Z"},"links":{"cited_paper":"/paper/2502.05512","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:a9b5e6eb4aa5ee81559086f7b91130af8dea72e403396762937308af88575053","observation_id":"eb1187fd-25e5-46d6-aa79-62e7fea4410d","resolution":{"observed_at":"2026-08-10T04:20:41.984640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21619","last_updated":"2025-09-03T10:46:35Z","snapshot_observed_at":"2026-08-08T06:46:54.528137Z","submitted_at":"2025-06-23T08:33:40Z","title":"IndexTTS2: A Breakthrough in Emotionally Expressive and Duration-Controlled Auto-Regressive Zero-Shot Text-to-Speech","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21619","snapshot_observed_at":"2026-08-10T04:20:41.988791Z","title":"arXiv preprint arXiv:2506.21619 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.988791Z"},"links":{"cited_paper":"/paper/2506.21619","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:49caaa7df1ae79030c75c1e4a41e55060f3e5e45e4c9c71d4672dd9e3e56dd88","observation_id":"becd0aca-8ccf-49e1-a195-9a55ee45444e","resolution":{"observed_at":"2026-08-10T04:20:41.988791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:41.992909Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.992909Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:50462017872342cd240cb6a7703cc3cff3963162126ddd35c694d7e6aeb891c6","observation_id":"7d774fb5-894e-498c-a697-6f51e3e3fd56","resolution":{"observed_at":"2026-08-10T04:20:41.992909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14345","last_updated":"2025-03-19T07:17:41Z","snapshot_observed_at":"2026-08-07T16:54:34.482866Z","submitted_at":"2025-03-18T15:25:08Z","title":"MoonCast: High-Quality Zero-Shot Podcast Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14345","snapshot_observed_at":"2026-08-10T04:20:41.997424Z","title":"arXiv preprint arXiv:2503.14345 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.997424Z"},"links":{"cited_paper":"/paper/2503.14345","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:310601910ca5ccf1b2cb1f58a6afd4bbba7a5fa0618a147503dcc78390d403b6","observation_id":"a5947d43-5271-4cc8-9721-e753a86b884b","resolution":{"observed_at":"2026-08-10T04:20:41.997424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06885","last_updated":"2025-05-20T15:53:10Z","snapshot_observed_at":"2026-08-01T23:52:25.071174Z","submitted_at":"2024-10-09T13:46:34Z","title":"F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06885","snapshot_observed_at":"2026-08-10T04:20:42.001817Z","title":"arXiv preprint arXiv:2410.06885 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.001817Z"},"links":{"cited_paper":"/paper/2410.06885","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:d3927c7fa54f2d9b5f32535e2e0f8286da73015897a18b37646129d1aac766ea","observation_id":"52c8acd8-0215-4f24-9c99-5f75fa950aa3","resolution":{"observed_at":"2026-08-10T04:20:42.001817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19205","last_updated":"2025-08-26T17:09:12Z","snapshot_observed_at":"2026-08-10T16:18:01.080043Z","submitted_at":"2025-08-26T17:09:12Z","title":"VibeVoice Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19205","snapshot_observed_at":"2026-08-10T04:20:42.006092Z","title":"arXiv preprint arXiv:2508.19205 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.006092Z"},"links":{"cited_paper":"/paper/2508.19205","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:bee68e4ee57386af28dff10034b4501af318ce15a290ebedf69b54c7d9cee53c","observation_id":"1877ea45-08bf-46bb-b2be-20a4feaf3258","resolution":{"observed_at":"2026-08-10T04:20:42.006092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:42.010980Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.010980Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:296b5054e001635f0dbf9f717c776df7c2ecdd8d493585d2864940bafd7f8525","observation_id":"ba1ba5c9-4f40-4ee3-8fc0-d4af39ff0f79","resolution":{"observed_at":"2026-08-10T04:20:42.010980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23009","last_updated":"2025-05-29T02:36:24Z","snapshot_observed_at":"2026-08-10T19:02:35.465470Z","submitted_at":"2025-05-29T02:36:24Z","title":"EmergentTTS-Eval: Evaluating TTS Models on Complex Prosodic, Expressiveness, and Linguistic Challenges Using Model-as-a-Judge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23009","snapshot_observed_at":"2026-08-10T04:20:42.015534Z","title":"arXiv preprint arXiv:2505.23009 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.015534Z"},"links":{"cited_paper":"/paper/2505.23009","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:77950a115b495da1e975d69cb7a277d21a20d6b036d0144a8fc5af26d8f21e2a","observation_id":"f71b31b5-6633-4897-8a5c-2ae7d83e2859","resolution":{"observed_at":"2026-08-10T04:20:42.015534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03930","last_updated":"2025-02-24T19:37:06Z","snapshot_observed_at":"2026-08-06T17:25:47.486446Z","submitted_at":"2024-10-04T21:13:58Z","title":"Reverb: Open-Source ASR and Diarization from Rev","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03930","snapshot_observed_at":"2026-08-10T04:20:42.020480Z","title":"arXiv preprint arXiv:2410.03930 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.020480Z"},"links":{"cited_paper":"/paper/2410.03930","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:3f04c31cf5354193733807d1d127b02f32e3b7a14d54f7179d4ea599b4d68618","observation_id":"4041c31d-64ed-44dc-b33f-4df08cdf30b4","resolution":{"observed_at":"2026-08-10T04:20:42.020480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:42.025512Z","title":"IEEE/ACM Transactions on Audio, Speech, and Language Processing , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.025512Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:29c290eee63e082c77f81be83ba7f2457d73c95e1eae2ca873bc44cbc5b21244","observation_id":"2a1db3e7-176f-411f-8b35-b3b79a683135","resolution":{"observed_at":"2026-08-10T04:20:42.025512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:42.030151Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.030151Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:e559ff7cfc50a8979609df66a79dc1e4739ffb242e054b4280944adcc8fc515b","observation_id":"6e69882a-fb36-4218-afe3-f141bc0c2e13","resolution":{"observed_at":"2026-08-10T04:20:42.030151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:42.035031Z","title":"Proceedings of the IEEE International Conference on Acoustics, Speech and Signal Processing , pages =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.035031Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:19deba06176493baf559c3035d5bf51a40d7c46145ab6c6cf66783123c21a5ca","observation_id":"bd855265-288b-491a-a9cd-2aee8b5369c2","resolution":{"observed_at":"2026-08-10T04:20:42.035031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03199","last_updated":"2024-01-09T21:02:34Z","snapshot_observed_at":"2026-07-06T16:15:23.878725Z","submitted_at":"2023-09-06T17:59:57Z","title":"Matcha-TTS: A fast TTS architecture with conditional flow matching","version":2},"cited_work":{"arxiv_id":"2309.03199","doi":"10.48550/arxiv.2309.03199","metadata_source":"pith","pith_arxiv_id":"2309.03199","snapshot_observed_at":"2026-08-10T06:16:20.510975Z","title":"Matcha-TTS: A fast TTS architecture with conditional flow matching","venue":"eess.AS","work_id":"7adb3c92-5cbc-4e02-9e60-cba43e18b765","year":2023},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.039660Z"},"links":{"cited_paper":"/paper/2309.03199","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:67ea06e6c326d196b0211e69f447a04e8cd2a071418b2034c78e5c73cc6e5c5e","observation_id":"f9cf2a7d-0e9d-463f-b11f-4d4d4eb0c92f","resolution":{"observed_at":"2026-08-10T04:20:43.025398Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:42.044946Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.044946Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:1d0796c863f6bbdbbdd82d522a8c68470806f97987ac9f8f5fbec6311490f7d8","observation_id":"02008a6d-fe53-4276-8905-43b119a14b1b","resolution":{"observed_at":"2026-08-10T04:20:42.044946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20215","last_updated":"2025-03-26T04:17:55Z","snapshot_observed_at":"2026-08-06T08:46:20.194739Z","submitted_at":"2025-03-26T04:17:55Z","title":"Qwen2.5-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20215","snapshot_observed_at":"2026-08-10T04:20:42.049433Z","title":"arXiv preprint arXiv:2503.20215 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.049433Z"},"links":{"cited_paper":"/paper/2503.20215","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:d3ff23ac3205dd748b94079c3655b1d48ac86052a136ab5220b598eac16139bf","observation_id":"d9a46543-bfad-467c-a76f-3fdad26ca0cb","resolution":{"observed_at":"2026-08-10T04:20:42.049433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:42.054192Z","title":"Proceedings of Interspeech , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.054192Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:2e489ef8c31274dba42c6f2b497dcd500c814161702a0601d03cdb396019d377","observation_id":"4f18e951-7b22-4c09-b136-564a0a6de1e6","resolution":{"observed_at":"2026-08-10T04:20:42.054192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:42.058596Z","title":"International Conference on Learning Representations , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.058596Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:635d138c4b2ea6e7789921218d7f2bb6c9ac42e36047111e53370683c33f308a","observation_id":"f613b2de-1418-45b3-a432-530021ebeae5","resolution":{"observed_at":"2026-08-10T04:20:42.058596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:42.062629Z","title":"Findings of the Association for Computational Linguistics: EACL 2024 , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.062629Z"},"links":{"citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:980305070ab5e4cc936d5c2f6c48115d86225dcbd7690629c18b86b05a4d79b4","observation_id":"7a44f162-5482-499d-a19a-36d181e17c57","resolution":{"observed_at":"2026-08-10T04:20:42.062629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-11T04:13:14.634775Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":89,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":159},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 159 outbound references and 0 inbound Pith citation observations for arXiv:2608.07462."}