{"as_of":"2026-08-07T12:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f8b68da168e6d20f4fc8e58d874febf8872167ade8f97211dfb28adddbb33e21","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:58:10.654286Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":32,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2110.03370","last_updated":"2022-02-23T06:42:31Z","snapshot_observed_at":"2026-08-03T17:48:08.897592Z","submitted_at":"2021-10-07T12:05:29Z","title":"WenetSpeech: A 10000+ Hours Multi-domain Mandarin Corpus for Speech Recognition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.03370","snapshot_observed_at":"2026-08-07T04:58:10.654286Z","title":"WENETSPEECH: A 10000+ hours multi-domain mandarin corpus for speech recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09344","last_updated":"2025-06-11T02:50:49Z","snapshot_observed_at":"2026-08-07T04:48:13.328915Z","submitted_at":"2025-06-11T02:50:49Z","title":"Ming-Omni: A Unified Multimodal Model for Perception and Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:10.654286Z"},"links":{"cited_paper":"/paper/2110.03370","citing_paper":"/paper/2506.09344"},"observation_digest":"sha256:f42224ee61ae81851ecf0ab5d2e428abeb2095a66e021e4559eec8b5238e42ba","observation_id":"19cd9c47-a240-4442-9e8b-0599fd5ce481","resolution":{"observed_at":"2026-08-07T04:58:10.654286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.03370","last_updated":"2022-02-23T06:42:31Z","snapshot_observed_at":"2026-08-03T17:48:08.897592Z","submitted_at":"2021-10-07T12:05:29Z","title":"WenetSpeech: A 10000+ Hours Multi-domain Mandarin Corpus for Speech Recognition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.03370","snapshot_observed_at":"2026-08-07T00:33:19.462794Z","title":"Wenetspeech: A 10000+ hours multi-domain mandarin corpus for speech recognition, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13642","last_updated":"2025-06-22T07:56:58Z","snapshot_observed_at":"2026-08-07T00:26:15.640270Z","submitted_at":"2025-06-16T16:06:45Z","title":"Stream-Omni: Simultaneous Multimodal Interactions with Large Language-Vision-Speech Model","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:33:19.462794Z"},"links":{"cited_paper":"/paper/2110.03370","citing_paper":"/paper/2506.13642"},"observation_digest":"sha256:81575ad36d4762259f44efe7fe84b800f7ee08120d4159fda7377db5988bcdde","observation_id":"8b54d6d9-9aaf-4136-a244-4645ab435966","resolution":{"observed_at":"2026-08-07T00:33:19.462794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.03370","last_updated":"2022-02-23T06:42:31Z","snapshot_observed_at":"2026-08-03T17:48:08.897592Z","submitted_at":"2021-10-07T12:05:29Z","title":"WenetSpeech: A 10000+ Hours Multi-domain Mandarin Corpus for Speech Recognition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.03370","snapshot_observed_at":"2026-08-06T23:35:32.604685Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17459","last_updated":"2025-06-20T19:59:49Z","snapshot_observed_at":"2026-08-06T23:28:24.764934Z","submitted_at":"2025-06-20T19:59:49Z","title":"Breaking the Transcription Bottleneck: Fine-tuning ASR Models for Extremely Low-Resource Fieldwork Languages","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T23:35:32.604685Z"},"links":{"cited_paper":"/paper/2110.03370","citing_paper":"/paper/2506.17459"},"observation_digest":"sha256:c19f66bb7fb0aae812ec179f46a85e41de364d7743d09d890681b5d72c6375d7","observation_id":"17c8c44b-5f15-4b71-a916-c3bd436ea1a7","resolution":{"observed_at":"2026-08-06T23:35:32.604685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.03370","last_updated":"2022-02-23T06:42:31Z","snapshot_observed_at":"2026-08-03T17:48:08.897592Z","submitted_at":"2021-10-07T12:05:29Z","title":"WenetSpeech: A 10000+ Hours Multi-domain Mandarin Corpus for Speech Recognition","version":5},"cited_work":{"arxiv_id":"2110.03370","doi":"10.48550/arxiv.2110.03370","metadata_source":"arxiv_reference","pith_arxiv_id":"2110.03370","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech: A 10000+ hours multi-domain mandarin corpus for speech recognition","venue":"arXiv (Cornell University)","work_id":"d9d8c5c7-1ac2-4db1-a92a-2dbe04bdda86","year":2022},"citing_paper":{"arxiv_id":"2507.16632","last_updated":"2025-08-27T16:42:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-22T14:23:55Z","title":"Step-Audio 2 Technical Report","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-16T05:59:50.900436Z"},"links":{"cited_paper":"/paper/2110.03370","citing_paper":"/paper/2507.16632"},"observation_digest":"sha256:e79b03e68f999fbdde04c0f35a8929709c0ac6fbc57731257a6b6d962596a7ba","observation_id":"0fdc7dad-ae15-41b2-b68d-4684f58df13e","resolution":{"observed_at":"2026-05-16T05:59:51.107662Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.03370","last_updated":"2022-02-23T06:42:31Z","snapshot_observed_at":"2026-08-03T17:48:08.897592Z","submitted_at":"2021-10-07T12:05:29Z","title":"WenetSpeech: A 10000+ Hours Multi-domain Mandarin Corpus for Speech Recognition","version":5},"cited_work":{"arxiv_id":"2110.03370","doi":"10.48550/arxiv.2110.03370","metadata_source":"arxiv_reference","pith_arxiv_id":"2110.03370","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech: A 10000+ hours multi-domain mandarin corpus for speech recognition","venue":"arXiv (Cornell University)","work_id":"d9d8c5c7-1ac2-4db1-a92a-2dbe04bdda86","year":2022},"citing_paper":{"arxiv_id":"2508.07285","last_updated":"2026-05-19T14:44:40Z","snapshot_observed_at":"2026-08-05T00:29:45.624756Z","submitted_at":"2025-08-10T10:46:14Z","title":"Non-Intrusive Automatic Speech Recognition Refinement: A Survey","version":3},"reference_index":136,"source":"pdf_text","source_observed_at":"2026-05-21T23:34:52.249143Z"},"links":{"cited_paper":"/paper/2110.03370","citing_paper":"/paper/2508.07285"},"observation_digest":"sha256:7fd3cbc913432ea3baf2babbbec084603543c0941d95fe9c701b6b5542000630","observation_id":"b71c0222-688f-4a27-9fe8-e363ad42f8be","resolution":{"observed_at":"2026-05-21T23:35:46.418333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.03370","last_updated":"2022-02-23T06:42:31Z","snapshot_observed_at":"2026-08-03T17:48:08.897592Z","submitted_at":"2021-10-07T12:05:29Z","title":"WenetSpeech: A 10000+ Hours Multi-domain Mandarin Corpus for Speech Recognition","version":5},"cited_work":{"arxiv_id":"2110.03370","doi":"10.48550/arxiv.2110.03370","metadata_source":"arxiv_reference","pith_arxiv_id":"2110.03370","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech: A 10000+ hours multi-domain mandarin corpus for speech recognition","venue":"arXiv (Cornell University)","work_id":"d9d8c5c7-1ac2-4db1-a92a-2dbe04bdda86","year":2022},"citing_paper":{"arxiv_id":"2605.28139","last_updated":"2026-05-27T08:22:47Z","snapshot_observed_at":"2026-08-05T12:11:37.559145Z","submitted_at":"2026-05-27T08:22:47Z","title":"Data-Efficient On-Policy Distillation for Automatic Speech Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T12:02:35.332633Z"},"links":{"cited_paper":"/paper/2110.03370","citing_paper":"/paper/2605.28139"},"observation_digest":"sha256:7ad8890859c4d08a11d7f873880a6f62cfb484fd6fc996bd5e6fa5447041837b","observation_id":"aed6896a-4747-4327-8c52-3fd2774666c3","resolution":{"observed_at":"2026-06-29T12:03:23.187584Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2110.03370/citation-record","integrity":"/paper/2110.03370/integrity","json":"/paper/2110.03370/citation-record.json","paper":"/paper/2110.03370"},"outbound":[],"paper":{"arxiv_id":"2110.03370","last_updated":"2022-02-23T06:42:31Z","latest_version":5,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-03T17:48:08.897592Z","submitted_at":"2021-10-07T12:05:29Z","title":"WenetSpeech: A 10000+ Hours Multi-domain Mandarin Corpus for Speech Recognition"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2110.03370."}