{"as_of":"2026-08-20T07:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a899942e021a9fed8ae99102e74cfeb20f33fea957317028a4025e7e68af5591","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T08:34:07.609421Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.05364/citation-record","integrity":"/paper/2607.05364/integrity","json":"/paper/2607.05364/citation-record.json","paper":"/paper/2607.05364"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-08-16T23:32:22.645653Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-02T08:34:02.593641Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:02.593641Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:d3cf95fe73988f51ef855c79edc4347afb890b1b22d98631ba75392716a3d0c4","observation_id":"1ffdb3e5-9d8a-4d49-9918-05548adc690b","resolution":{"observed_at":"2026-08-02T08:34:02.593641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06670","last_updated":"2020-03-05T20:37:08Z","snapshot_observed_at":"2026-08-12T13:38:15.911519Z","submitted_at":"2019-12-13T19:22:44Z","title":"Common Voice: A Massively-Multilingual Speech Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06670","snapshot_observed_at":"2026-08-02T08:34:02.641142Z","title":"Com- mon V oice: A massively-multilingual speech corpus,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:02.641142Z"},"links":{"cited_paper":"/paper/1912.06670","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:6406142ac893005e269a7946d3a1c4832b1148918f28dad0a81b6dbe06e1cce2","observation_id":"b3cbbfa1-9c6c-4a0a-ac99-8ca4a6c40ae0","resolution":{"observed_at":"2026-08-02T08:34:02.641142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15646","last_updated":"2025-05-21T15:24:29Z","snapshot_observed_at":"2026-08-19T22:56:04.029080Z","submitted_at":"2025-05-21T15:24:29Z","title":"Word Level Timestamp Generation for Automatic Speech Recognition and Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15646","snapshot_observed_at":"2026-08-02T08:34:02.696146Z","title":"Word level timestamp generation for automatic speech recognition and translation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:02.696146Z"},"links":{"cited_paper":"/paper/2505.15646","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:7a4158a73821e0f7509608587cc072a3f9706a4ccda2e065c71063626075787a","observation_id":"f45fb52e-531b-4ab7-bdae-ec25e6d94d36","resolution":{"observed_at":"2026-08-02T08:34:02.696146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.22817","last_updated":"2026-04-14T20:56:24Z","snapshot_observed_at":"2026-08-15T16:45:55.846802Z","submitted_at":"2026-04-14T20:56:24Z","title":"In-Sync: Adaptation of Speech Aware Large Language Models for ASR with Word Level Timestamp Predictions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.22817","snapshot_observed_at":"2026-08-02T08:34:02.743566Z","title":"In-Sync: Adaptation of speech aware large language models for ASR with word level timestamp predictions,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:02.743566Z"},"links":{"cited_paper":"/paper/2604.22817","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:3ec35ac7d7d371f6f836c2d9356557408a14e21efae417fe8fb2695add4ed5af","observation_id":"a18c4571-f0e2-48e2-826c-81b40253878e","resolution":{"observed_at":"2026-08-02T08:34:02.743566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:02.801641Z","title":"Listening between the frames: Bridging temporal gaps in large audio-language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:02.801641Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:ffc40b500a3a2c514f5066076c7c4b2fa92737be31748973e6b4b69aa9039617","observation_id":"2e910b67-6922-44cb-87a7-3654c34f4a01","resolution":{"observed_at":"2026-08-02T08:34:02.801641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-02T08:34:02.884792Z","title":"Distilling the knowledge in a neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:02.884792Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:1e51bb8d4281103d2c51e1191536238c24a6e8de10ed2522411cbf07adc420a9","observation_id":"ef23a525-8250-425c-ab2e-11b100d3c459","resolution":{"observed_at":"2026-08-02T08:34:02.884792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:02.980701Z","title":"Learning without forgetting,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:02.980701Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:23d943d21ea56dbca368935fe524d0e82e4eccb86661b62f3c5ce5e86534c2bb","observation_id":"c43b7e8b-5fe6-40ac-b177-40bee61a02e8","resolution":{"observed_at":"2026-08-02T08:34:02.980701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:03.033027Z","title":"Overcoming catastrophic forgetting in neural networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:03.033027Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:56f8b2925d8d8ae387984fee590532f85e4988c75c885daf3b5f1356e0b545ef","observation_id":"07cf12ba-404c-46e4-932a-ffc0dad8736f","resolution":{"observed_at":"2026-08-02T08:34:03.033027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:03.188098Z","title":"Gradient episodic memory for continual learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:03.188098Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:a72f9f285afb9b3d5c8cb32ab3c47f7b8aebcfeff07ca0401f068a18a4657f2a","observation_id":"184956d7-5c26-4ffe-a315-69ae420cb087","resolution":{"observed_at":"2026-08-02T08:34:03.188098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:03.329208Z","title":"Dark experience for general continual learning: A strong, simple baseline,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:03.329208Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:4f65e4066d580f87a99b7da4f5e2c54a9fa677ebc4ceca84cef36ded784466a1","observation_id":"9e786492-f912-462c-9ef9-943f204f432b","resolution":{"observed_at":"2026-08-02T08:34:03.329208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:03.465530Z","title":"WhisperX: Time-accurate speech transcription of long-form audio,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:03.465530Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:9d1ee1a89210f1a94eaba3dd2a286e8fe595cffed896232d2508e15fac1917d1","observation_id":"2bf3070d-31e3-4994-9900-e352b50aef09","resolution":{"observed_at":"2026-08-02T08:34:03.465530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:03.606250Z","title":"Montreal Forced Aligner: Trainable text-speech alignment using Kaldi,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:03.606250Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:bc0dc222b80418166c9fb01ca7c61fa87a43a3e65133f8940526e389ca32ddbf","observation_id":"1f46a112-866c-42d0-b8f9-261ae27e00db","resolution":{"observed_at":"2026-08-02T08:34:03.606250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:03.643140Z","title":"The Kaldi speech recognition toolkit,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:03.643140Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:38b697f65912e713949a2a1afa0e53a69e16bf285b6822c0256a63cfcdeebc8d","observation_id":"6ae44956-fd59-43a2-880d-17826d5cdd46","resolution":{"observed_at":"2026-08-02T08:34:03.643140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19363","last_updated":"2024-06-27T17:45:34Z","snapshot_observed_at":"2026-08-19T20:44:52.948520Z","submitted_at":"2024-06-27T17:45:34Z","title":"Tradition or Innovation: A Comparison of Modern ASR Methods for Forced Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19363","snapshot_observed_at":"2026-08-02T08:34:03.748612Z","title":"Tradition or inno- vation: A comparison of modern ASR methods for forced alignment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:03.748612Z"},"links":{"cited_paper":"/paper/2406.19363","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:5dbaf6d557baf3ea5fcded12d7e59bae98d2852b29458c3764bdd1e3c186a3e8","observation_id":"695be922-6d80-41ce-b855-00d37267e7fe","resolution":{"observed_at":"2026-08-02T08:34:03.748612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.09127","last_updated":"2020-10-05T07:46:24Z","snapshot_observed_at":"2026-08-07T19:22:34.733073Z","submitted_at":"2020-07-17T17:38:08Z","title":"CTC-Segmentation of Large Corpora for German End-to-end Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.09127","snapshot_observed_at":"2026-08-02T08:34:03.790802Z","title":"CTC- segmentation of large corpora for German end-to-end speech recogni- tion,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:03.790802Z"},"links":{"cited_paper":"/paper/2007.09127","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:819a2d6685840c27fda7583a9271a5ade70ad6648801639bea23c59df737f33b","observation_id":"a7e0ca6a-c31d-46e8-aee9-da8e82e24567","resolution":{"observed_at":"2026-08-02T08:34:03.790802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:03.836028Z","title":"LLM- ForcedAligner: A non-autoregressive and accurate LLM-based forced aligner for multilingual and long-form speech,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:03.836028Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:655d24b4b6ad5ccc94048c064f31f491fb04002e4f8c47f84c4102d897e4bb8e","observation_id":"603f6899-74a5-4fb4-b4a4-d845bd4714c0","resolution":{"observed_at":"2026-08-02T08:34:03.836028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16589","last_updated":"2024-08-29T14:52:42Z","snapshot_observed_at":"2026-08-19T04:10:23.301736Z","submitted_at":"2024-08-29T14:52:42Z","title":"CrisperWhisper: Accurate Timestamps on Verbatim Speech Transcriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16589","snapshot_observed_at":"2026-08-02T08:34:03.851086Z","title":"CrisperWhisper: Accu- rate timestamps on verbatim speech transcriptions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:03.851086Z"},"links":{"cited_paper":"/paper/2408.16589","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:b8554555126efa39254a6b0b6de2d6dbf282ba1f591252e0948edbcb4816addf","observation_id":"65962cd3-9e8d-4bb7-926b-0a1d4086f1ae","resolution":{"observed_at":"2026-08-02T08:34:03.851086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09987","last_updated":"2025-09-12T06:03:24Z","snapshot_observed_at":"2026-08-18T22:20:07.247779Z","submitted_at":"2025-09-12T06:03:24Z","title":"Whisper Has an Internal Word Aligner","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09987","snapshot_observed_at":"2026-08-02T08:34:03.907710Z","title":"Whisper has an internal word aligner,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:03.907710Z"},"links":{"cited_paper":"/paper/2509.09987","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:1bda8637b8995328925b0966179b10a4441db6287962ee18c49fb19e49508a0d","observation_id":"cb603aa2-6bbb-4f39-b6b1-9787c93f9800","resolution":{"observed_at":"2026-08-02T08:34:03.907710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.03588","last_updated":"2022-01-11T14:26:11Z","snapshot_observed_at":"2026-08-18T16:47:37.777973Z","submitted_at":"2019-06-09T07:51:23Z","title":"rVAD: An Unsupervised Segment-Based Robust Voice Activity Detection Method","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.03588","snapshot_observed_at":"2026-08-02T08:34:03.970899Z","title":"rV AD: An unsupervised segment-based robust voice activity detection method,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:03.970899Z"},"links":{"cited_paper":"/paper/1906.03588","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:78fe14565a4941e06adf9b061e20a5d1d851cec17bba221a2420e8f7ddf59d04","observation_id":"02433610-cd3b-4ea3-afec-156789e68f76","resolution":{"observed_at":"2026-08-02T08:34:03.970899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:04.019898Z","title":"Investigation of Whisper ASR hallucinations induced by non-speech audio,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.019898Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:bbbf38cc5a17c3a8f14e3a5c17212f0e83daea1279fbe80ea1fbe42da4382953","observation_id":"98b4a681-6706-4e5e-8f3c-9111daf52831","resolution":{"observed_at":"2026-08-02T08:34:04.019898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12969","last_updated":"2025-05-19T11:04:52Z","snapshot_observed_at":"2026-08-18T12:17:43.521747Z","submitted_at":"2025-05-19T11:04:52Z","title":"Calm-Whisper: Reduce Whisper Hallucination On Non-Speech By Calming Crazy Heads Down","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12969","snapshot_observed_at":"2026-08-02T08:34:04.140302Z","title":"Calm-Whisper: Reduce Whisper hallucination on non-speech by calm- ing crazy heads down,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.140302Z"},"links":{"cited_paper":"/paper/2505.12969","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:982c855a4b7240239e1a55dd20ce3beb824caefb363ccc7fdae1b74e75961bbc","observation_id":"c90ec813-1833-481c-99b9-f3f4b694d30b","resolution":{"observed_at":"2026-08-02T08:34:04.140302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12414","last_updated":"2025-06-04T23:04:18Z","snapshot_observed_at":"2026-08-18T21:50:02.715250Z","submitted_at":"2025-02-18T01:25:39Z","title":"Lost in Transcription, Found in Distribution Shift: Demystifying Hallucination in Speech Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12414","snapshot_observed_at":"2026-08-02T08:34:04.184711Z","title":"Lost in transcription, found in distribution shift: Demystifying hallucination in speech foundation models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.184711Z"},"links":{"cited_paper":"/paper/2502.12414","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:cda7b480bd9d32f150e8a84c86701bd2bfe3744f93df880627d7780078ded5e1","observation_id":"722748dd-c678-4658-ab77-dc74913e186e","resolution":{"observed_at":"2026-08-02T08:34:04.184711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:04.259645Z","title":"AHa-Bench: Benchmarking audio hallucinations in large audio-language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.259645Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:f54b4f9596439769109e4c38b0d0eca6be04b505cc5b610ae10a98ad3ffa0b85","observation_id":"dfdde7db-223f-4805-8750-ec9aa31d5c81","resolution":{"observed_at":"2026-08-02T08:34:04.259645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.23060","last_updated":"2026-06-22T09:13:04Z","snapshot_observed_at":"2026-08-14T22:07:17.016130Z","submitted_at":"2026-06-22T09:13:04Z","title":"From Text Metrics to Model Internals: A Study of Whisper ASR Hallucination Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.23060","snapshot_observed_at":"2026-08-02T08:34:04.363306Z","title":"From text metrics to model internals: A study of Whisper ASR hallucination detection,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.363306Z"},"links":{"cited_paper":"/paper/2606.23060","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:60c1f5eb73ce2c8f3c1ea98c7417921855251cc6a33211853b10b0232c87ba12","observation_id":"9de1f168-eb81-448c-b904-b3bd68cda657","resolution":{"observed_at":"2026-08-02T08:34:04.363306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07473","last_updated":"2026-06-05T17:26:23Z","snapshot_observed_at":"2026-08-20T03:43:32.153639Z","submitted_at":"2026-06-05T17:26:23Z","title":"Whisper Hallucination Detection and Mitigation via Hidden Representation Steering and Sparse AutoEncoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07473","snapshot_observed_at":"2026-08-02T08:34:04.449157Z","title":"Whisper hallu- cination detection and mitigation via hidden representation steering and sparse autoencoders,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.449157Z"},"links":{"cited_paper":"/paper/2606.07473","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:7581036e0bad774cef823dd09b0c4d640e48bebfd402708790764e6a633429b1","observation_id":"80d300bf-1e0d-4e34-884d-6500a2dbaffe","resolution":{"observed_at":"2026-08-02T08:34:04.449157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11130","last_updated":"2025-06-16T15:47:41Z","snapshot_observed_at":"2026-08-07T04:54:43.738701Z","submitted_at":"2025-06-10T17:30:32Z","title":"A Self-Refining Framework for Enhancing ASR Using TTS-Synthesized Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11130","snapshot_observed_at":"2026-08-02T08:34:04.507414Z","title":"A self-refining framework for enhanc- ing ASR using TTS-synthesized data,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.507414Z"},"links":{"cited_paper":"/paper/2506.11130","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:25e66b1ff1f9e7c72853e782861b4f92179a1012ed13f018ad9aebe652d72730","observation_id":"219c8161-cbe9-43e2-a9b9-94e4ba10c391","resolution":{"observed_at":"2026-08-02T08:34:04.507414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:04.639625Z","title":"Channel-aware domain-adaptive generative adversarial network for robust speech recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.639625Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:54376451bf890356d36ff74ea018d7abae5984f88d13f4bf775961a145dc6ae2","observation_id":"066636ac-0d51-4c28-a15d-9a9c87796466","resolution":{"observed_at":"2026-08-02T08:34:04.639625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19037","last_updated":"2025-05-25T08:37:55Z","snapshot_observed_at":"2026-08-17T12:03:52.615757Z","submitted_at":"2025-05-25T08:37:55Z","title":"Speech-IFEval: Evaluating Instruction-Following and Quantifying Catastrophic Forgetting in Speech-Aware Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19037","snapshot_observed_at":"2026-08-02T08:34:04.723035Z","title":"Speech-IFEval: Evaluating instruction-following and quantifying catastrophic forgetting in speech- aware language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.723035Z"},"links":{"cited_paper":"/paper/2505.19037","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:dfb51d039e3d91b3f4158db048a8472084373c7d8618cc38aea05942af42a996","observation_id":"f2bd38d6-64e9-4c8f-9144-a718b81b1678","resolution":{"observed_at":"2026-08-02T08:34:04.723035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:04.851566Z","title":"Scheduled sampling for sequence prediction with recurrent neural networks,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.851566Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:a935c0ae512a82db955502a0669f576563ef5fd51c0347d82d2f53b49b968da0","observation_id":"b5a7fbc6-ddad-41ee-8118-64e9743e02fa","resolution":{"observed_at":"2026-08-02T08:34:04.851566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:04.879827Z","title":"Dynamic-SUPERB Phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.879827Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:809f3236263eef7a7c7e8cdaa6cfcb0000a5bfd294e6ee719e0e6a68ccce6394","observation_id":"7557301e-7241-47cf-8fb6-80bb29e19dd7","resolution":{"observed_at":"2026-08-02T08:34:04.879827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:04.942344Z","title":"SUPERB: Speech processing universal performance benchmark,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.942344Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:cb9ff20f50f4cfbfa10dd6c2f698269043d31023552f8d9df788b30238c002ba","observation_id":"878eaff8-8aa0-402f-8b15-5eb36fd0f8e9","resolution":{"observed_at":"2026-08-02T08:34:04.942344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:04.996667Z","title":"ML-SUPERB: Multilingual speech universal performance benchmark,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:04.996667Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:6c29eecfd4dfe359bd8ba4b073cebee1aed6eccd5e98f39231220b96b6212c1f","observation_id":"1fe95b42-940c-42e0-9609-fb02723ac753","resolution":{"observed_at":"2026-08-02T08:34:04.996667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:05.087471Z","title":"HEAR: Holistic evaluation of audio representations,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:05.087471Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:f066ea881d7b8f7766754620f97832adddc6d18832b9953ba39520057f16d224","observation_id":"c5964911-4ee4-4b2e-a700-719d338ce703","resolution":{"observed_at":"2026-08-02T08:34:05.087471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-08-19T21:31:31.421076Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-08-02T08:34:05.200834Z","title":"AIR-Bench: Benchmarking large audio-language models via generative comprehen- sion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:05.200834Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:29dd395a21276055e7e4931f18a81a76e4f1a5f4b036015fe5e3d5fe4f46434e","observation_id":"b4e88589-4075-4e31-82ee-d7115afe1b33","resolution":{"observed_at":"2026-08-02T08:34:05.200834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16020","last_updated":"2025-05-06T00:52:19Z","snapshot_observed_at":"2026-08-19T06:44:38.018743Z","submitted_at":"2024-06-23T05:40:26Z","title":"AudioBench: A Universal Benchmark for Audio Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16020","snapshot_observed_at":"2026-08-02T08:34:05.324498Z","title":"AudioBench: A universal benchmark for audio large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:05.324498Z"},"links":{"cited_paper":"/paper/2406.16020","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:444b301e4e78f3a4e9a220929d045d9a069ae3bc5c786e52dafa74f4329b2cf0","observation_id":"7b4e7f6d-8971-441e-87c9-1faa15b3e281","resolution":{"observed_at":"2026-08-02T08:34:05.324498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:05.382080Z","title":"MMAU: A massive multi-task audio understanding and reasoning benchmark,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:05.382080Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:73046cea9ee154b6a275a1c35aad1fe36d3d2f5eaf2f4e704adc606ee86601fc","observation_id":"2d1b7339-0b52-4fbb-97b2-2f7e3b75c083","resolution":{"observed_at":"2026-08-02T08:34:05.382080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:05.432705Z","title":"AudioMarathon: A comprehensive benchmark for long-context audio understanding and efficiency in audio LLMs,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:05.432705Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:4b22c5f895b2c85a2b93b5caa42907f60c6fdcc4b97ab0f681ee06b505d23ebb","observation_id":"40b3f580-ed53-42a5-a851-e90280492b59","resolution":{"observed_at":"2026-08-02T08:34:05.432705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:05.535011Z","title":"Not in Sync: Unveiling temporal bias in audio chat models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:05.535011Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:59431cb108c6ad0d87ccc8d6600dcbdaf4bac7d5944ef876eef2f2a2afdf3df6","observation_id":"4257fe3c-2b01-4a05-98b2-c03357c9728b","resolution":{"observed_at":"2026-08-02T08:34:05.535011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13023","last_updated":"2026-08-10T09:20:13Z","snapshot_observed_at":"2026-08-14T13:37:59.572304Z","submitted_at":"2026-04-14T17:57:01Z","title":"SpotSound: Enhancing Large Audio-Language Models with Fine-Grained Temporal Grounding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.13023","snapshot_observed_at":"2026-08-02T08:34:05.690467Z","title":"SpotSound: Enhancing large audio-language models with fine-grained temporal grounding,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:05.690467Z"},"links":{"cited_paper":"/paper/2604.13023","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:b7a92d7ecd22b0021707559d521b06603f0ca2419c29014aea93c7f23e9379bf","observation_id":"2b267c34-47ea-4e78-9324-5006d8c2ac52","resolution":{"observed_at":"2026-08-02T08:34:05.690467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.04876","last_updated":"2026-05-27T05:39:51Z","snapshot_observed_at":"2026-08-17T17:01:49.021591Z","submitted_at":"2026-01-08T12:21:09Z","title":"ChronosAudio: A Comprehensive Long-Audio Benchmark for Evaluating Audio-Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.04876","snapshot_observed_at":"2026-08-02T08:34:05.792775Z","title":"ChronosAudio: A comprehensive long-audio benchmark for evaluating audio-large language models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:05.792775Z"},"links":{"cited_paper":"/paper/2601.04876","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:c95c02e90e07ed78ea173fbebbb3f0208bf5b5713e45f2002bf7d89b4e84516f","observation_id":"95172167-5665-4c30-baf5-f61376f6819d","resolution":{"observed_at":"2026-08-02T08:34:05.792775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:05.877887Z","title":"STAR-Bench: Probing deep spatio-temporal reasoning as audio 4D intelligence,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:05.877887Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:10cbeebcf3faec8b8491c7638907084a4b1351381086316dd2fcc909131421f4","observation_id":"d6178851-a237-4168-a9cc-19b499cfd01c","resolution":{"observed_at":"2026-08-02T08:34:05.877887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:06.050275Z","title":"Audio Set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:06.050275Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:c3283f278f9482f3eb2899eccd019066c92207b743df15715fd36f28fef88122","observation_id":"83cbaf1b-1063-4f83-82bc-8780722e9ce8","resolution":{"observed_at":"2026-08-02T08:34:06.050275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:06.082006Z","title":"AudioCaps: Generating captions for audios in the wild,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:06.082006Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:5259a92f72134e620db9009a49d791da1d00fa891ad84d578919a73e6cdc4714","observation_id":"88fad0f1-8926-40aa-878f-63b6a4ddf506","resolution":{"observed_at":"2026-08-02T08:34:06.082006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:06.145311Z","title":"Clotho: An audio captioning dataset,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:06.145311Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:9935ca0394d2201cb7aa7eb88df0b805a5d39fc9f9a71450af61989fe10f73fe","observation_id":"ee8435bc-121e-4231-894e-e94ff2379a97","resolution":{"observed_at":"2026-08-02T08:34:06.145311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:06.247989Z","title":"Clotho- AQA: A crowdsourced dataset for audio question answering,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:06.247989Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:536b5ea668b6be4fb4e10575c59e08113098665929e90640e6fd36766082f83e","observation_id":"cc0bc37e-ff5f-4fd0-badf-11792419cd16","resolution":{"observed_at":"2026-08-02T08:34:06.247989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:06.322307Z","title":"ToxicTone: A Mandarin audio dataset annotated for toxicity and toxic utterance tonality,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:06.322307Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:7b9bad6fa02bcb9b3138a3d7b2f1be715897433edab8d9a9d440bf8ecb02e62b","observation_id":"b34b3702-cfd4-4746-9d49-026aa7bf9050","resolution":{"observed_at":"2026-08-02T08:34:06.322307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18217","last_updated":"2025-01-05T13:07:32Z","snapshot_observed_at":"2026-08-17T11:30:20.987636Z","submitted_at":"2024-11-27T10:51:00Z","title":"How to Learn a New Language? An Efficient Solution for Self-Supervised Learning Models Unseen Languages Adaption in Low-Resource Scenario","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18217","snapshot_observed_at":"2026-08-02T08:34:06.419976Z","title":"How to learn a new language? An efficient solution for self-supervised learning models unseen languages adaption in low-resource scenario,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:06.419976Z"},"links":{"cited_paper":"/paper/2411.18217","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:fd8d49b63dd7789dc958dfdafff421c1349465fdad26c4bc790e0574cb1de67d","observation_id":"b64ee07b-05ca-4b2c-82dd-aee23969141b","resolution":{"observed_at":"2026-08-02T08:34:06.419976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:06.565520Z","title":"Parameter-efficient transfer learning for NLP,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:06.565520Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:4e77a9d5aafea3244f7acd12a8e2de496843dca714f7858af326353f42b05980","observation_id":"3d46c1c5-fb5d-4421-a10f-05bffb6dcde6","resolution":{"observed_at":"2026-08-02T08:34:06.565520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:06.611521Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:06.611521Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:cd58a972d3f982104df6916fd06888de16ed4a298ba6f05ac7da5dcfd9b603b9","observation_id":"da1823e0-e26e-44e3-8e8b-05c794bc9424","resolution":{"observed_at":"2026-08-02T08:34:06.611521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:06.691073Z","title":"Prefix-tuning: Optimizing continuous prompts for generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:06.691073Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:e725f951386845a0890e4eb227d7109873b4f7fee183bcfcdea1dbec8cd9682a","observation_id":"4ced987a-5ff0-485b-8c94-a8e43237f11e","resolution":{"observed_at":"2026-08-02T08:34:06.691073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:06.773703Z","title":"The power of scale for parameter-efficient prompt tuning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:06.773703Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:59c516007c76f60f1d96a4142ad198597326d651cb03b99b6ec55fe930d5ad94","observation_id":"6491b14e-3da1-4013-850b-afa9faebdf7a","resolution":{"observed_at":"2026-08-02T08:34:06.773703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:06.897032Z","title":"BitFit: Simple parameter- efficient fine-tuning for transformer-based masked language-models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:06.897032Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:3234497e885fabf04245e874f845ec6a161574ca80719bf411290c52e2f95ebe","observation_id":"d0d7d2b4-bc38-429a-b653-dae854b47fa3","resolution":{"observed_at":"2026-08-02T08:34:06.897032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:06.976853Z","title":"Few-shot parameter-efficient fine-tuning is better and cheaper than in-context learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:06.976853Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:1726cebd20710e6a8953d64ce2dc0073948b8866bc7923f606f4854f42b94c69","observation_id":"c9a74677-515f-4dae-b2e4-4163c6d6bdc7","resolution":{"observed_at":"2026-08-02T08:34:06.976853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:07.090576Z","title":"ASCEND: A spontaneous Chinese-English dataset for code- switching in multi-turn conversation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:07.090576Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:1debef568ddadd1666b39403fd479980cc843b079a18bd6e74390a09a25d4ad5","observation_id":"ff153f3a-9737-47d4-b1d2-19223289b9f6","resolution":{"observed_at":"2026-08-02T08:34:07.090576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00430","last_updated":"2023-11-01T10:45:07Z","snapshot_observed_at":"2026-08-19T15:33:09.556542Z","submitted_at":"2023-11-01T10:45:07Z","title":"Distil-Whisper: Robust Knowledge Distillation via Large-Scale Pseudo Labelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00430","snapshot_observed_at":"2026-08-02T08:34:07.135568Z","title":"Distil-Whisper: Robust knowledge distillation via large-scale pseudo labelling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:07.135568Z"},"links":{"cited_paper":"/paper/2311.00430","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:bc49c7ef427dcbadb4600500d04b99aa879469a05f5ab51e0cefd80a8b4a0c49","observation_id":"0117172f-3b7c-4650-afc5-d12ac89ab204","resolution":{"observed_at":"2026-08-02T08:34:07.135568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-08-14T01:27:16.843576Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-02T08:34:07.203925Z","title":"Qwen2-Audio technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:07.203925Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:7d09b031d7ce517499d79c8446921ac6e266147ee9e07e47a20546c40700dd80","observation_id":"90996d41-f42b-47a0-8717-a9f79f51f953","resolution":{"observed_at":"2026-08-02T08:34:07.203925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20215","last_updated":"2025-03-26T04:17:55Z","snapshot_observed_at":"2026-08-06T08:46:20.194739Z","submitted_at":"2025-03-26T04:17:55Z","title":"Qwen2.5-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20215","snapshot_observed_at":"2026-08-02T08:34:07.291518Z","title":"Qwen2.5-Omni technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:07.291518Z"},"links":{"cited_paper":"/paper/2503.20215","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:488444bb1f2378aeca7c6fb32ff115905ab65b5922eec7e09e8031d6f8ebaa98","observation_id":"80d76507-3b18-43e2-b6fc-74d2e0422ab4","resolution":{"observed_at":"2026-08-02T08:34:07.291518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-08-11T00:14:34.061687Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-08-02T08:34:07.367186Z","title":"Qwen3-Omni technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:07.367186Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:a1ebfc61a52e4c10bcd3b2e0c2fe7c66573ea8995aa70bb754b89eeebda53806","observation_id":"9dea83a3-d61d-4061-a76b-009d454a535a","resolution":{"observed_at":"2026-08-02T08:34:07.367186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.01802","last_updated":"2026-06-05T13:33:35Z","snapshot_observed_at":"2026-08-16T10:18:33.973164Z","submitted_at":"2026-06-01T07:19:22Z","title":"MOSS-Audio Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.01802","snapshot_observed_at":"2026-08-02T08:34:07.442930Z","title":"MOSS-Audio technical report,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:07.442930Z"},"links":{"cited_paper":"/paper/2606.01802","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:1f83c384c6986a245925249e23830ad7393e3487ee3133c0ef6460f57b359769","observation_id":"259ddbf8-222e-4dfc-9a60-ca007a266265","resolution":{"observed_at":"2026-08-02T08:34:07.442930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:07.523718Z","title":"VIBEVOICE-ASR technical report,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:07.523718Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:4af0800afdd29554ea13c60ac471c6de094ee893edce1d329c1b925fcec72dcc","observation_id":"1d2e4cf9-12b3-4ea6-96b3-68c9db72f11f","resolution":{"observed_at":"2026-08-02T08:34:07.523718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:34:07.609421Z","title":"DeSTA2.5-Audio: Toward general-purpose large audio language model with self-generated cross-modal alignment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:07.609421Z"},"links":{"citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:024c55c6c956c767e6480eb6768530482ee0dfd5d6eb46a2ef11ef889f610021","observation_id":"a8e7beec-a3ca-4e7f-967c-849999d780ae","resolution":{"observed_at":"2026-08-02T08:34:07.609421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T21:16:03.653789Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":61,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2607.05364."}