{"as_of":"2026-08-15T19:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a4e9ce59e5631c82e4ecfa0c996ce88dbb94bd978ff122b56509e182b5fcd2d3","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T12:00:45.279735Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.20499","last_updated":"2025-05-26T11:34:20Z","snapshot_observed_at":"2026-08-14T18:01:41.768577Z","submitted_at":"2025-03-26T12:39:06Z","title":"FireRedTTS-1S: An Upgraded Streamable Foundation Text-to-Speech System","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20499","snapshot_observed_at":"2026-08-05T12:00:45.279735Z","title":"Fireredtts-1s: An upgraded streamable foundation text-to-speech system","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02020","last_updated":"2025-09-04T03:36:39Z","snapshot_observed_at":"2026-08-15T08:18:32.827110Z","submitted_at":"2025-09-02T07:06:46Z","title":"FireRedTTS-2: Towards Long Conversational Speech Generation for Podcast and Chatbot","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T12:00:45.279735Z"},"links":{"cited_paper":"/paper/2503.20499","citing_paper":"/paper/2509.02020"},"observation_digest":"sha256:63e7d6442416873258fc0c46d2d138031828bee9720ac92c39f2e3b56a77eb60","observation_id":"489b64a4-604d-404a-9fa5-6e6923f7132c","resolution":{"observed_at":"2026-08-05T12:00:45.279735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20499","last_updated":"2025-05-26T11:34:20Z","snapshot_observed_at":"2026-08-14T18:01:41.768577Z","submitted_at":"2025-03-26T12:39:06Z","title":"FireRedTTS-1S: An Upgraded Streamable Foundation Text-to-Speech System","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20499","snapshot_observed_at":"2026-08-04T23:33:04.295185Z","title":"Fireredtts-1s: An upgraded streamable foundation text-to-speech system.arXiv preprint arXiv:2503.20499, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06502","last_updated":"2025-09-08T10:07:30Z","snapshot_observed_at":"2026-08-12T21:09:54.215392Z","submitted_at":"2025-09-08T10:07:30Z","title":"FireRedChat: A Pluggable, Full-Duplex Voice Interaction System with Cascaded and Semi-Cascaded Implementations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T23:33:04.295185Z"},"links":{"cited_paper":"/paper/2503.20499","citing_paper":"/paper/2509.06502"},"observation_digest":"sha256:5771ecd0a8b2293823513bb60576b650922ced2f1b777d530268f4825a7e0d34","observation_id":"fb92917a-2c22-4077-bdc3-fbce6b7367a6","resolution":{"observed_at":"2026-08-04T23:33:04.295185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20499","last_updated":"2025-05-26T11:34:20Z","snapshot_observed_at":"2026-08-14T18:01:41.768577Z","submitted_at":"2025-03-26T12:39:06Z","title":"FireRedTTS-1S: An Upgraded Streamable Foundation Text-to-Speech System","version":3},"cited_work":{"arxiv_id":"2503.20499","doi":"10.48550/arxiv.2503.20499","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.20499","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireredtts-1s: An upgraded streamable foundation text-to-speech system.arXiv preprint arXiv:2503.20499","venue":"ArXiv.org","work_id":"e4e8341c-b6d4-4d4d-865b-3baff0793b26","year":2025},"citing_paper":{"arxiv_id":"2510.15148","last_updated":"2026-04-04T21:55:10Z","snapshot_observed_at":"2026-08-15T12:00:03.929140Z","submitted_at":"2025-10-16T21:10:22Z","title":"XModBench: Benchmarking Cross-Modal Capabilities and Consistency in Omni-Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T05:45:07.700571Z"},"links":{"cited_paper":"/paper/2503.20499","citing_paper":"/paper/2510.15148"},"observation_digest":"sha256:6b848424087cc18a34330a17fbf6e9578f1a3e5d20076edd87b0d6248e4b5657","observation_id":"ed2fe049-f705-467e-81ab-2d54c370975c","resolution":{"observed_at":"2026-05-18T05:45:56.154116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20499","last_updated":"2025-05-26T11:34:20Z","snapshot_observed_at":"2026-08-14T18:01:41.768577Z","submitted_at":"2025-03-26T12:39:06Z","title":"FireRedTTS-1S: An Upgraded Streamable Foundation Text-to-Speech System","version":3},"cited_work":{"arxiv_id":"2503.20499","doi":"10.48550/arxiv.2503.20499","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.20499","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireredtts-1s: An upgraded streamable foundation text-to-speech system.arXiv preprint arXiv:2503.20499","venue":"ArXiv.org","work_id":"e4e8341c-b6d4-4d4d-865b-3baff0793b26","year":2025},"citing_paper":{"arxiv_id":"2604.17958","last_updated":"2026-04-20T08:39:55Z","snapshot_observed_at":"2026-08-14T03:21:39.243837Z","submitted_at":"2026-04-20T08:39:55Z","title":"MINT-Bench: A Comprehensive Multilingual Benchmark for Instruction-Following Text-to-Speech","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T04:03:38.919545Z"},"links":{"cited_paper":"/paper/2503.20499","citing_paper":"/paper/2604.17958"},"observation_digest":"sha256:636cba33061d9eb740a0ba0fc862f76119daf200f5d228780698bc8555f10f06","observation_id":"47d591df-aabf-44e5-94e1-c33a28d6aecd","resolution":{"observed_at":"2026-05-10T04:04:47.255869Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20499","last_updated":"2025-05-26T11:34:20Z","snapshot_observed_at":"2026-08-14T18:01:41.768577Z","submitted_at":"2025-03-26T12:39:06Z","title":"FireRedTTS-1S: An Upgraded Streamable Foundation Text-to-Speech System","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20499","snapshot_observed_at":"2026-07-11T21:24:36.925360Z","title":"Fireredtts-1s: An upgraded stream- able foundation text-to-speech system.arXiv preprint arXiv:2503.20499,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04140","last_updated":"2026-07-05T06:45:47Z","snapshot_observed_at":"2026-08-06T05:51:10.452020Z","submitted_at":"2026-07-05T06:45:47Z","title":"DELTA-TTS: Adapting Autoregressive Model into Diffusion Language Model for Text-to-Speech","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T21:24:36.925360Z"},"links":{"cited_paper":"/paper/2503.20499","citing_paper":"/paper/2607.04140"},"observation_digest":"sha256:178b177c8f4b68acbeadb631034768d5181994b0906e38fafd70f83a4941e1af","observation_id":"7fe01c66-4063-4154-9cfc-698f52ad4763","resolution":{"observed_at":"2026-07-11T21:24:36.925360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.20499/citation-record","integrity":"/paper/2503.20499/integrity","json":"/paper/2503.20499/citation-record.json","paper":"/paper/2503.20499"},"outbound":[],"paper":{"arxiv_id":"2503.20499","last_updated":"2025-05-26T11:34:20Z","latest_version":3,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-14T18:01:41.768577Z","submitted_at":"2025-03-26T12:39:06Z","title":"FireRedTTS-1S: An Upgraded Streamable Foundation Text-to-Speech System"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2503.20499."}