{"as_of":"2026-08-09T10:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:31453c7c58939a25099b335411a1b1c6ec1af7a0a3b7f269605d461a81967739","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:29:00.417808Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-07T11:29:00.417808Z","title":"Fireredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm integration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02443","last_updated":"2025-06-03T05:02:14Z","snapshot_observed_at":"2026-08-09T03:40:47.360103Z","submitted_at":"2025-06-03T05:02:14Z","title":"Breaking the Barriers of Text-Hungry and Audio-Deficient AI","version":1},"reference_index":148,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:00.417808Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2506.02443"},"observation_digest":"sha256:5107fff6b797a5775366a72589d97b97e8d23bddfd4c76ecd963823813ea478e","observation_id":"c473e8c4-75c6-40e3-a4de-1e42ab0f59c6","resolution":{"observed_at":"2026-08-07T11:29:00.417808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-06T18:10:19.311880Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Mod- els from Encoder-Decoder to LLM Integration,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09116","last_updated":"2025-07-19T16:25:24Z","snapshot_observed_at":"2026-08-08T18:08:27.256482Z","submitted_at":"2025-07-12T02:14:50Z","title":"Mixture of LoRA Experts with Multi-Modal and Multi-Granularity LLM Generative Error Correction for Accented Speech Recognition","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:19.311880Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2507.09116"},"observation_digest":"sha256:a7f9345590337cd73759a79e725c0e8c631c9ffb91770a954d806c4a9b00773c","observation_id":"2ef851e9-e40a-4f62-b371-32b5b68955c2","resolution":{"observed_at":"2026-08-06T18:10:19.311880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T16:18:50.718283Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition ModelsfromEncoder-DecodertoLLMIntegration,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18732","last_updated":"2025-08-26T07:00:12Z","snapshot_observed_at":"2026-08-07T01:09:10.988212Z","submitted_at":"2025-08-26T07:00:12Z","title":"Cross-Learning Fine-Tuning Strategy for Dysarthric Speech Recognition Via CDSD database","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T16:18:50.718283Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2508.18732"},"observation_digest":"sha256:20aa300a5c565d433b0a9a89ae9efaa91e530dedc3bf7281556ecf99beed917b","observation_id":"99e48a47-b488-4d56-92f9-75431e2117fe","resolution":{"observed_at":"2026-08-05T16:18:50.718283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T10:36:02.306865Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.306865Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:29532cb4c57760ce0328a606c0ce1da6b1ffb8ab844fa881419dc4bd42234886","observation_id":"7e8d036a-9b51-4646-ae0e-bb34e373869d","resolution":{"observed_at":"2026-08-05T10:36:02.306865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-04T23:33:04.254815Z","title":"Fireredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm integration.arXiv preprint arXiv:2501.14350, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06502","last_updated":"2025-09-08T10:07:30Z","snapshot_observed_at":"2026-08-06T19:22:29.209698Z","submitted_at":"2025-09-08T10:07:30Z","title":"FireRedChat: A Pluggable, Full-Duplex Voice Interaction System with Cascaded and Semi-Cascaded Implementations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T23:33:04.254815Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2509.06502"},"observation_digest":"sha256:129325d052cbcb66e169759659b88bce36c3d300c3a77bf2f8482442fc926947","observation_id":"d967b855-1997-4bd7-af2c-283bdc1ed2aa","resolution":{"observed_at":"2026-08-04T23:33:04.254815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-04T08:55:40.021982Z","title":"Fireredasr: Open-source industrial- grade mandarin speech recognition models from encoder-decoder to llm integration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.18416","last_updated":"2026-05-28T16:36:58Z","snapshot_observed_at":"2026-08-08T04:29:50.324848Z","submitted_at":"2025-10-21T08:48:04Z","title":"SegTune: Structured and Fine-Grained Control for Song Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T08:55:40.021982Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2510.18416"},"observation_digest":"sha256:e62b17f37eee0ffc118e0e8a94a8cc586d20c5a51cd27aa2b13940cb6c0131dc","observation_id":"3e1af290-f611-4b70-b20c-f2dbcc6ff061","resolution":{"observed_at":"2026-08-04T08:55:40.021982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-07-15T13:22:58.005580Z","title":"Fireredasr: Open- source industrial-grade mandarin speech recognition mod- els from encoder-decoder to LLM integration,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07262","last_updated":"2026-07-13T11:38:19Z","snapshot_observed_at":"2026-08-07T07:49:16.888784Z","submitted_at":"2026-03-07T15:39:36Z","title":"Existence of the longest arcs for left-invariant three-dimensional contact sub-Lorentzian structures","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-15T13:22:58.005580Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2603.07262"},"observation_digest":"sha256:a11d127067093d55ba59086ac633de9ae20220f7adb780abfe668c65d22411e0","observation_id":"ec9d05dd-ff1c-4c5a-aa14-4d71a466ce3a","resolution":{"observed_at":"2026-07-15T13:22:58.005580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2603.15045","last_updated":"2026-07-07T07:07:08Z","snapshot_observed_at":"2026-08-01T21:49:24.005109Z","submitted_at":"2026-03-16T09:57:06Z","title":"LLMs and Speech: Integration vs. Combination","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T10:41:22.138517Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2603.15045"},"observation_digest":"sha256:94df9867b0aa75deb2a6e6c5470370505ecccc6f2124ed165fab778454a100a0","observation_id":"82bc387f-687c-4970-9090-2ef3559ae628","resolution":{"observed_at":"2026-05-15T10:45:28.349651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-07-14T20:46:17.286576Z","title":"Fireredasr: Open- source industrial-grade mandarin speech recognition models from encoder-decoder to llm integration,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15045","last_updated":"2026-07-07T07:07:08Z","snapshot_observed_at":"2026-08-01T21:49:24.005109Z","submitted_at":"2026-03-16T09:57:06Z","title":"LLMs and Speech: Integration vs. Combination","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T20:46:17.286576Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2603.15045"},"observation_digest":"sha256:d62a9f14dd1d5d0bdefb7e434e4bb480e43c35a21fb13db78378f912514cba4d","observation_id":"061fbd71-59ee-4b54-8252-39203b88512b","resolution":{"observed_at":"2026-07-14T20:46:17.286576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2604.09121","last_updated":"2026-04-14T06:45:50Z","snapshot_observed_at":"2026-08-02T20:05:01.635841Z","submitted_at":"2026-04-10T09:02:42Z","title":"Interactive ASR: Towards Human-Like Interaction and Semantic Coherence Evaluation for Agentic Speech Recognition","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T18:22:08.670559Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2604.09121"},"observation_digest":"sha256:5bc8eaa7e99345b0d057bc12bf440884366199dc9b61ab17bcaa22426e336328","observation_id":"81d205d0-c295-4987-b96a-312761b61059","resolution":{"observed_at":"2026-05-11T00:41:07.177531Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2605.04613","last_updated":"2026-05-06T08:03:31Z","snapshot_observed_at":"2026-08-02T05:05:09.769581Z","submitted_at":"2026-05-06T08:03:31Z","title":"VocalParse: Towards Unified and Scalable Singing Voice Transcription with Large Audio Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T16:59:25.973854Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2605.04613"},"observation_digest":"sha256:b55eb7bfc696e132109d8a448c992506ee4c5d220d606df9e8683fd9b236243a","observation_id":"37d39fea-1205-42a6-8fe9-e7fee4c359f5","resolution":{"observed_at":"2026-05-11T17:51:09.768681Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2605.08961","last_updated":"2026-05-09T13:56:54Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T13:56:54Z","title":"Dolphin-CN-Dialect: Where Chinese Dialects Matter","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T02:13:42.268229Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2605.08961"},"observation_digest":"sha256:382b7a71e28a019097021e292c973e38957026a517288a3196fdbf3ba30a50ca","observation_id":"2c4fe42c-885e-41b3-9a43-2b8b69f853a6","resolution":{"observed_at":"2026-05-12T02:16:16.144675Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2605.23598","last_updated":"2026-05-22T13:06:46Z","snapshot_observed_at":"2026-08-05T16:03:21.062446Z","submitted_at":"2026-05-22T13:06:46Z","title":"When Youth Enter the Algorithmic Wild: Discovering and Understanding Potentially Harmful Teen Videos on Douyin and Kwai","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-25T04:20:27.456558Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2605.23598"},"observation_digest":"sha256:c5527e1fd105e104fab6a1b81f7afcc2c3b762831e34fea32cadb621e6fa11a1","observation_id":"4689b2a8-5cb7-419b-8c22-0623c1cbb594","resolution":{"observed_at":"2026-05-25T04:25:19.816729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2605.27258","last_updated":"2026-05-26T16:36:56Z","snapshot_observed_at":"2026-08-06T13:26:23.950630Z","submitted_at":"2026-05-26T16:36:56Z","title":"PilotTTS: A Disciplined Modular Recipe for Competitive Speech Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T15:51:21.519785Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2605.27258"},"observation_digest":"sha256:6109f4c44889e1c47ca97a32e4924a16a99a9204a5e917a74e05e8ef656116a2","observation_id":"49876449-2efa-40d3-9570-e9d683424d94","resolution":{"observed_at":"2026-06-29T16:23:39.871989Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2605.28480","last_updated":"2026-05-27T13:39:14Z","snapshot_observed_at":"2026-08-07T09:43:33.557408Z","submitted_at":"2026-05-27T13:39:14Z","title":"Audio-Mind: An Auditable Agentic Framework for Audio Understanding","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-29T10:03:54.653164Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2605.28480"},"observation_digest":"sha256:97a96e9b278aac2c6aad8801ec3b4b659949933cec8a2a882a61499b24a14c13","observation_id":"0edb7d8a-b937-42d0-a225-51d7743eb8b3","resolution":{"observed_at":"2026-06-29T10:13:17.609016Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2605.29430","last_updated":"2026-05-28T06:23:31Z","snapshot_observed_at":"2026-08-07T03:26:40.138742Z","submitted_at":"2026-05-28T06:23:31Z","title":"Towards Human-Like Interactive Speech Recognition With Agentic Correction and Semantic Evaluation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-29T07:30:11.718647Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2605.29430"},"observation_digest":"sha256:bfd2d36ba917db471991660ba4c1a1d5da8a540b0ab987539f8617c7409a5fa8","observation_id":"409ae099-8b61-45de-8e73-82819403d8ea","resolution":{"observed_at":"2026-06-29T07:33:13.699366Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2605.30366","last_updated":"2026-05-18T03:43:41Z","snapshot_observed_at":"2026-08-04T20:00:25.137382Z","submitted_at":"2026-05-18T03:43:41Z","title":"Escaping the Linearity Trap: Manifold Detours for Black-Box Adversarial Attacks on Singing Audio Deepfake Detection","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-30T18:58:31.318883Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2605.30366"},"observation_digest":"sha256:5434667ebec1e89ecc200f6633c075db4b41f0750e7020f246ce47cb8fecb8cf","observation_id":"728c662a-2e2f-40b8-a27a-ce2e589e715b","resolution":{"observed_at":"2026-06-30T19:05:01.096878Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2606.05121","last_updated":"2026-06-03T17:26:11Z","snapshot_observed_at":"2026-08-02T17:56:34.317060Z","submitted_at":"2026-06-03T17:26:11Z","title":"Audio Interaction Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:05.062465Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2606.05121"},"observation_digest":"sha256:468d04cf5dcf74bb14bbdacdfc3496a2c0a58620376d3f78af207a89e6f883b2","observation_id":"a2f41b5e-9ac4-48b6-af16-2626ff96ffca","resolution":{"observed_at":"2026-07-02T10:46:52.394885Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2606.05763","last_updated":"2026-06-04T06:44:54Z","snapshot_observed_at":"2026-08-08T06:14:05.969071Z","submitted_at":"2026-06-04T06:44:54Z","title":"M2S-AVSR: Modality-aware Multi-view Self-supervised Representation for Robust Audio-Visual Speech Recognition","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-27T23:58:21.046264Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2606.05763"},"observation_digest":"sha256:f392bdc272cd2a85fb38932b3b529efa3f7edc466ca3c97c2d69cde9b82799df","observation_id":"44bcf260-2066-443b-ac45-90f76c2211ce","resolution":{"observed_at":"2026-07-02T15:17:07.856430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2606.05852","last_updated":"2026-06-04T08:27:17Z","snapshot_observed_at":"2026-08-09T07:53:36.714139Z","submitted_at":"2026-06-04T08:27:17Z","title":"UniVoice: A Unified Model for Speech and Singing Voice Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T23:56:14.198308Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2606.05852"},"observation_digest":"sha256:1f14ad41cbe1c9f24ecb09a435c347e731e49b3d0505fbc26f9fbbb116b5f130","observation_id":"24c79568-2382-4f08-a202-d0419832de3f","resolution":{"observed_at":"2026-07-02T15:17:08.272060Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2606.07015","last_updated":"2026-06-05T07:59:17Z","snapshot_observed_at":"2026-08-07T10:25:26.085858Z","submitted_at":"2026-06-05T07:59:17Z","title":"Towards Unified Song Generation and Singing Voice Conversion with Accompaniment Co-Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T21:14:08.243894Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2606.07015"},"observation_digest":"sha256:3a16beb17a19d6a60a840e1313f514a51cb2fad66ee5af36994f929ef1fc0eb8","observation_id":"b0165a76-7221-4605-89ae-6eee2fa7616e","resolution":{"observed_at":"2026-07-02T19:57:19.608806Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":"2501.14350","doi":"10.48550/arxiv.2501.14350","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fir- eredasr: Open-source industrial-grade mandarin speech recognition models from encoder-decoder to llm inte- gration","venue":"ArXiv.org","work_id":"62974ced-2120-413e-8766-01dae954001d","year":2025},"citing_paper":{"arxiv_id":"2607.01733","last_updated":"2026-07-02T05:42:01Z","snapshot_observed_at":"2026-08-06T21:21:57.811880Z","submitted_at":"2026-07-02T05:42:01Z","title":"Rethinking Speech-LLM Integration for ASR: Effective Joint Speech-Text Training by Interleaving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-03T15:17:52.966144Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2607.01733"},"observation_digest":"sha256:4964b64e5fcfdea40cda4d1dc5af2803eb6667fa964c1f236aadca84711d6ede","observation_id":"acc687e0-3e9e-45ef-bc4b-ed5ef2f99f97","resolution":{"observed_at":"2026-07-03T15:18:32.665746Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.14350/citation-record","integrity":"/paper/2501.14350/integrity","json":"/paper/2501.14350/citation-record.json","paper":"/paper/2501.14350"},"outbound":[],"paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2501.14350."}