{"as_of":"2026-08-08T06:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d6118710d22bd6e3350cf4e4594892a80afd8ef79a93479d3db2aaebafd36963","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T01:07:25.099655Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T12:29:52.091018Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15591","snapshot_observed_at":"2026-08-07T01:07:25.099655Z","title":"Earnings-22: A practical benchmark for accents in the wild,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12154","last_updated":"2025-06-13T18:19:09Z","snapshot_observed_at":"2026-08-08T05:51:37.906884Z","submitted_at":"2025-06-13T18:19:09Z","title":"Adapting Whisper for Streaming Speech Recognition via Two-Pass Decoding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T01:07:25.099655Z"},"links":{"cited_paper":"/paper/2203.15591","citing_paper":"/paper/2506.12154"},"observation_digest":"sha256:4e395291053dc9250cddff380e1548ed3f37cf9a7953e8b36fe58e42a7e15b07","observation_id":"93dc0f56-3c94-4a0f-abbd-4311cbcc27ba","resolution":{"observed_at":"2026-08-07T01:07:25.099655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15591","snapshot_observed_at":"2026-08-06T18:33:18.252620Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07877","last_updated":"2025-08-01T20:13:43Z","snapshot_observed_at":"2026-08-07T19:11:17.494477Z","submitted_at":"2025-07-10T16:00:27Z","title":"Edge-ASR: Towards Low-Bit Quantization of Automatic Speech Recognition Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:18.252620Z"},"links":{"cited_paper":"/paper/2203.15591","citing_paper":"/paper/2507.07877"},"observation_digest":"sha256:7934f52171d755e5531dda2702020cbc4ddb338a47d0d248aa24e63153b4c24b","observation_id":"c7b34894-504f-44e4-9ae6-b92691c24421","resolution":{"observed_at":"2026-08-06T18:33:18.252620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15591","snapshot_observed_at":"2026-08-03T12:02:01.760567Z","title":"D., Ha, P., McNamara, Q., Miller, C., and Chandra, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06199","last_updated":"2026-06-01T03:39:22Z","snapshot_observed_at":"2026-08-06T01:59:30.134013Z","submitted_at":"2026-01-08T07:46:03Z","title":"FastSLM: Hierarchical Temporal Abstraction for Efficient Long-Form Speech Adaptation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T12:02:01.760567Z"},"links":{"cited_paper":"/paper/2203.15591","citing_paper":"/paper/2601.06199"},"observation_digest":"sha256:20f86609e7065e862597333d8b7a74367db6020e6ff15b8e475e82e242e708a7","observation_id":"7c50972b-c718-49fe-b665-2acc8d624ed3","resolution":{"observed_at":"2026-08-03T12:02:01.760567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15591","snapshot_observed_at":"2026-08-03T12:01:00.692815Z","title":"Earnings-22: A practical benchmark for ac cents in the wild,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.19919","last_updated":"2026-06-01T03:38:43Z","snapshot_observed_at":"2026-08-06T20:50:24.633588Z","submitted_at":"2026-01-08T08:05:30Z","title":"ASKD-Whisper: Adaptive Self-knowledge Distillation for Efficient and Low-Latency Automatic Speech Recognition","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T12:01:00.692815Z"},"links":{"cited_paper":"/paper/2203.15591","citing_paper":"/paper/2601.19919"},"observation_digest":"sha256:d7c4c9be5cafd7ecfe30c04c8b1fe80031cd617dc4dcdb6dea6c819c88ebd400","observation_id":"b2ab651f-c346-4439-a1a5-af915a21c347","resolution":{"observed_at":"2026-08-03T12:01:00.692815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15591","snapshot_observed_at":"2026-07-15T13:58:09.323985Z","title":"Available: https://arxiv.org/abs/2203.15591","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.06193","last_updated":"2026-06-22T08:34:44Z","snapshot_observed_at":"2026-08-07T11:10:36.480076Z","submitted_at":"2026-03-06T12:04:12Z","title":"Whisper-CD: Accurate Long-Form Speech Recognition using Multi-Negative Contrastive Decoding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-15T13:58:09.323985Z"},"links":{"cited_paper":"/paper/2203.15591","citing_paper":"/paper/2603.06193"},"observation_digest":"sha256:f0b8e9c277d8054913a6c750c0288f08dc89730469e1fe59a74a0d90a3360a0b","observation_id":"df672d5f-e445-406b-aef2-a8684eb0d41e","resolution":{"observed_at":"2026-07-15T13:58:09.323985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","version":1},"cited_work":{"arxiv_id":"2203.15591","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.15591","snapshot_observed_at":"2026-07-04T12:29:52.091018Z","title":"Earnings-22: A practical benchmark for accents in the wild","venue":null,"work_id":"08f20a51-8071-4da8-aeb8-740367682349","year":2022},"citing_paper":{"arxiv_id":"2604.07354","last_updated":"2026-03-28T05:09:16Z","snapshot_observed_at":"2026-08-03T02:29:10.738696Z","submitted_at":"2026-03-28T05:09:16Z","title":"Contextual Earnings-22: A Speech Recognition Benchmark with Custom Vocabulary in the Wild","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-14T23:10:32.547423Z"},"links":{"cited_paper":"/paper/2203.15591","citing_paper":"/paper/2604.07354"},"observation_digest":"sha256:91a265b593580b6cdd453e2fb126344de7858922e3e57602a77511aa1878cd21","observation_id":"1197be17-8057-40d5-944c-29df36a2df19","resolution":{"observed_at":"2026-05-14T23:13:16.237158Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15591","snapshot_observed_at":"2026-07-12T20:09:57.922788Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.14603","last_updated":"2026-06-29T06:44:20Z","snapshot_observed_at":"2026-07-12T20:09:54.804124Z","submitted_at":"2026-04-16T04:21:32Z","title":"A Synonymous Variational Perspective on the Rate-Distortion-Perception Tradeoff","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-12T20:09:57.922788Z"},"links":{"cited_paper":"/paper/2203.15591","citing_paper":"/paper/2604.14603"},"observation_digest":"sha256:12621bc1a0a1ce445472b9d78bc5a7e5a76154f0e96699d607a31effd3a84584","observation_id":"1a1f0de8-e50e-4092-916b-feb35ece35a2","resolution":{"observed_at":"2026-07-12T20:09:57.922788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","version":1},"cited_work":{"arxiv_id":"2203.15591","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.15591","snapshot_observed_at":"2026-07-04T12:29:52.091018Z","title":"Earnings-22: A practical benchmark for accents in the wild","venue":null,"work_id":"08f20a51-8071-4da8-aeb8-740367682349","year":2022},"citing_paper":{"arxiv_id":"2604.14604","last_updated":"2026-04-16T04:22:11Z","snapshot_observed_at":"2026-08-01T20:57:25.785838Z","submitted_at":"2026-04-16T04:22:11Z","title":"Hijacking Large Audio-Language Models via Context-Agnostic and Imperceptible Auditory Prompt Injection","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-10T11:32:10.126062Z"},"links":{"cited_paper":"/paper/2203.15591","citing_paper":"/paper/2604.14604"},"observation_digest":"sha256:1b2ca10cb49436b538e3b2766dc5074fce9ff904107380a1604c59b4930aa7bc","observation_id":"f9d141b0-71f2-437a-969c-495c993a5bad","resolution":{"observed_at":"2026-05-10T11:35:18.902153Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","version":1},"cited_work":{"arxiv_id":"2203.15591","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.15591","snapshot_observed_at":"2026-07-04T12:29:52.091018Z","title":"Earnings-22: A practical benchmark for accents in the wild","venue":null,"work_id":"08f20a51-8071-4da8-aeb8-740367682349","year":2022},"citing_paper":{"arxiv_id":"2604.27543","last_updated":"2026-04-30T07:48:27Z","snapshot_observed_at":"2026-08-04T03:33:27.029531Z","submitted_at":"2026-04-30T07:48:27Z","title":"AppTek Call-Center Dialogues: A Multi-Accent Long-Form Benchmark for English ASR","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T09:12:14.094145Z"},"links":{"cited_paper":"/paper/2203.15591","citing_paper":"/paper/2604.27543"},"observation_digest":"sha256:e0254b171b1753bc57ffd1e95b82b526eeec5599d78af63f0413a50be69f15ef","observation_id":"9240a5d7-d1b7-45e1-95d0-6e8087d0dd95","resolution":{"observed_at":"2026-05-12T09:46:27.886668Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","version":1},"cited_work":{"arxiv_id":"2203.15591","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.15591","snapshot_observed_at":"2026-07-04T12:29:52.091018Z","title":"Earnings-22: A practical benchmark for accents in the wild","venue":null,"work_id":"08f20a51-8071-4da8-aeb8-740367682349","year":2022},"citing_paper":{"arxiv_id":"2606.08486","last_updated":"2026-06-07T07:15:34Z","snapshot_observed_at":"2026-07-06T23:47:57.376596Z","submitted_at":"2026-06-07T07:15:34Z","title":"TRADE: Transducer-Augmented Decoder for Speech LLM","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-27T18:40:19.688550Z"},"links":{"cited_paper":"/paper/2203.15591","citing_paper":"/paper/2606.08486"},"observation_digest":"sha256:35ffd6a5716fe9b8fb230ae42899934ff8734e0ad527ae7d752b39f54378dad2","observation_id":"b6cc8408-cf10-4607-b1aa-99700b1e52bd","resolution":{"observed_at":"2026-07-02T22:47:25.689000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","version":1},"cited_work":{"arxiv_id":"2203.15591","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.15591","snapshot_observed_at":"2026-07-04T12:29:52.091018Z","title":"Earnings-22: A practical benchmark for accents in the wild","venue":null,"work_id":"08f20a51-8071-4da8-aeb8-740367682349","year":2022},"citing_paper":{"arxiv_id":"2606.23048","last_updated":"2026-06-22T08:57:16Z","snapshot_observed_at":"2026-08-02T23:13:10.543214Z","submitted_at":"2026-06-22T08:57:16Z","title":"HALAS: A Human-Annotated Dataset of Hallucinations of Modern ASR Systems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T06:43:55.605662Z"},"links":{"cited_paper":"/paper/2203.15591","citing_paper":"/paper/2606.23048"},"observation_digest":"sha256:6154051e46e3bf47bb7e8252e205448519abb17a1ecb2c33cc785d47824b138c","observation_id":"dd55d850-44cd-4ab7-b937-64645e8a8fc1","resolution":{"observed_at":"2026-07-04T12:29:52.092439Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15591","snapshot_observed_at":"2026-07-30T11:46:28.421735Z","title":"Available: https://arxiv.org/abs/2203.15591","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23813","last_updated":"2026-07-26T19:24:00Z","snapshot_observed_at":"2026-08-05T21:28:16.724745Z","submitted_at":"2026-07-26T19:24:00Z","title":"Earnings25: A Comprehensive 500-Hour Speech Benchmark for Finance","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-07-30T11:46:28.421735Z"},"links":{"cited_paper":"/paper/2203.15591","citing_paper":"/paper/2607.23813"},"observation_digest":"sha256:ef281b814490d95a1316d74f0b45afc78f741e41a636e2a24a141c2b41ff307e","observation_id":"c1222fdf-f403-44c5-8a72-311ecfe929c0","resolution":{"observed_at":"2026-07-30T11:46:28.421735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2203.15591/citation-record","integrity":"/paper/2203.15591/integrity","json":"/paper/2203.15591/citation-record.json","paper":"/paper/2203.15591"},"outbound":[],"paper":{"arxiv_id":"2203.15591","last_updated":"2022-03-29T14:02:57Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T14:02:57Z","title":"Earnings-22: A Practical Benchmark for Accents in the Wild"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2203.15591."}