{"as_of":"2026-08-04T15:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bea3d397a66b801e6e3b2aac7f43233990a1a9db6c8e1c462c4d586b0532da33","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T09:47:04.846051Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.28884/citation-record","integrity":"/paper/2606.28884/integrity","json":"/paper/2606.28884/citation-record.json","paper":"/paper/2606.28884"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:47:04.817200Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.817200Z"},"links":{"citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:11756386c4c7e066378ccab845211717cc0c12ab7a881c5a761e3754ae9d6a1c","observation_id":"d1a6efac-72b1-46c0-98db-c37f87b93c45","resolution":{"observed_at":"2026-08-02T09:47:04.817200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:47:04.820209Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.820209Z"},"links":{"citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:815e11bb6215e94b08b7faf6a323860b34d61255256fc20ded562ba6e4a13d68","observation_id":"36017096-66f5-4d7a-8dee-1bd794545b5f","resolution":{"observed_at":"2026-08-02T09:47:04.820209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:47:04.823160Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.823160Z"},"links":{"citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:f6a9f66cb2a0682a5b8d592cbd87060f02b2cb74903fae128acd69386e206f0f","observation_id":"dcdb626c-d0a5-4a70-a40d-ebbd09e84484","resolution":{"observed_at":"2026-08-02T09:47:04.823160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:47:04.826005Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.826005Z"},"links":{"citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:79004289aabf8de103477f21070540161ef7353c136ed6b0db5875de32fee03e","observation_id":"9d1a0e81-a60e-4c83-87ac-d122332953f5","resolution":{"observed_at":"2026-08-02T09:47:04.826005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:47:04.828794Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.828794Z"},"links":{"citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:21635c925647f7af633678de24e7423cdea446276d790070de3cad7496714323","observation_id":"a9fa3f88-c5d7-4710-986a-cc39f15e35d5","resolution":{"observed_at":"2026-08-02T09:47:04.828794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:47:04.831563Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.831563Z"},"links":{"citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:0917e15d3a21cd95e34db7bc5ce99a23d95c86c6f4fb9e14b069e9fecae3da07","observation_id":"471f7d87-bb1c-4f37-a942-35e214e68792","resolution":{"observed_at":"2026-08-02T09:47:04.831563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:47:04.834562Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.834562Z"},"links":{"citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:d94f6a5e47c395e815345942015eea45d94ef4054f0abac678f385df380885aa","observation_id":"9a2be4e6-1945-423c-b182-9ac09e55b2a2","resolution":{"observed_at":"2026-08-02T09:47:04.834562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:47:04.837169Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.837169Z"},"links":{"citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:e0bc06b2e6790091ac4092232356fbae38753be6551e2754c648d6a59c84fa58","observation_id":"587b010f-49fe-42b8-a661-86af395c09fd","resolution":{"observed_at":"2026-08-02T09:47:04.837169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:47:04.839820Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.839820Z"},"links":{"citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:5ef039e971db49a0e086be1ad85fe3e266a9cf993c726a9ccafaed6cf2f3b9d8","observation_id":"d84d02ee-f8b4-46cf-a0bd-d1836060615d","resolution":{"observed_at":"2026-08-02T09:47:04.839820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:47:04.842345Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.842345Z"},"links":{"citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:9868b8dc2d5b4ab29021d02eb8672f6e63038e95831845f9db787266d227b1b7","observation_id":"dc2e62f8-143f-4d11-a867-3b36fbc374fd","resolution":{"observed_at":"2026-08-02T09:47:04.842345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:47:04.846051Z","title":"Overall, the data are concentrated in short-to-medium utterances, with the vast majority of audio segments falling between 0.5 and 10 seconds","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.846051Z"},"links":{"citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:2b41f442e0636ac8887eefea5cc097e5437a4d3b21cc8dfa1c0b30a55fa9de6c","observation_id":"60fbf8f7-821b-43fa-9278-8af52100365c","resolution":{"observed_at":"2026-08-02T09:47:04.846051Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09025","last_updated":"2020-10-19T14:10:10Z","snapshot_observed_at":"2026-08-04T14:24:24.611946Z","submitted_at":"2020-09-18T18:54:15Z","title":"COMET: A Neural Framework for MT Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09025","snapshot_observed_at":"2026-08-02T09:47:04.813630Z","title":"InInternational conference on machine learning, pages 28492–28518","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.813630Z"},"links":{"cited_paper":"/paper/2009.09025","citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:431cbfca29bd1949d324a9dce473ce2b2219cfb0de9868b70adf4fd432fc47b8","observation_id":"1118d0ee-f6fd-4346-ab40-3b09cc65bbc2","resolution":{"observed_at":"2026-08-02T09:47:04.813630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-02T09:47:04.809072Z","title":"Deepak Babu Piskala","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T09:47:04.809072Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2606.28884"},"observation_digest":"sha256:6b0fe3cb8f7c223311099fe843403367d8501d56c0f347fa91cc0bb80c9d767f","observation_id":"f46bee48-2e08-439b-ba8a-b9494f38bd17","resolution":{"observed_at":"2026-08-02T09:47:04.809072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.28884","last_updated":"2026-07-21T08:58:37Z","latest_version":3,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-02T09:47:04.332714Z","submitted_at":"2026-06-27T12:14:02Z","title":"GigaSpeechBench: A Real-World Multilingual Speech-to-Text Benchmark"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2606.28884."}