{"as_of":"2026-08-15T22:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:19cf33e0d5981ed48afb471dc870ac58d12b0a699ffc163356b9d09dbe10771d","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T00:13:50.278588Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.24863/citation-record","integrity":"/paper/2605.24863/integrity","json":"/paper/2605.24863/citation-record.json","paper":"/paper/2605.24863"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:13:50.278588Z","title":"AFT: An exemplar-free class incremental learning method for en- vironmental sound classification","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:e95c8057c97a74dd72b1e7d5eafc91886cc29796c57f8f575bdfa33646e641b9","observation_id":"c129b68b-e6cf-48e0-aacf-82718ba827d8","resolution":{"observed_at":"2026-06-30T00:13:50.278588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-08-14T01:27:16.843576Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":"2407.10759","doi":"10.48550/arxiv.2407.10759","metadata_source":"pith","pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2-Audio Technical Report","venue":"eess.AS","work_id":"c249e63c-cf40-408f-a4ff-fdf68e8cbeb8","year":2024},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:268757ccc64792a6b35202e950c0fcdf4414456d412a59d940302b327f946e45","observation_id":"25168432-d4f4-4f79-8e6b-ec52247ee8bf","resolution":{"observed_at":"2026-06-30T00:14:04.006152Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.13632","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T01:37:30.619849Z","title":"Closing the gap between text and speech under- standing in llms","venue":null,"work_id":"3d4fe369-c396-4eb2-b021-8c3fe119526d","year":2025},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:1c0adaf62ce7fd11da3ed1a824e221e1e5e78b327e241c598773c44924211abe","observation_id":"090366d2-51c7-47d0-9a72-af0a132e54ac","resolution":{"observed_at":"2026-06-30T00:14:04.013937Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v39i15.33770","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"De Lange, M., Aljundi, R., Masana, M., Parisot, S., Jia, X., Leonardis, A., Slabaugh, G., and Tuytelaars, T","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"d3242fef-dad0-4299-8c10-e1527d271654","year":null},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:cbac291c13356f31736b3920b37d79d13ba32c424f57c2f0d7594c7ccc27b9b5","observation_id":"d8ca090e-337d-454d-ace7-38ab1674b17f","resolution":{"observed_at":"2026-06-30T00:14:03.860450Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15793","last_updated":"2024-10-28T12:41:35Z","snapshot_observed_at":"2026-08-13T23:55:53.403530Z","submitted_at":"2024-07-22T16:51:28Z","title":"CLIP with Generative Latent Replay: a Strong Baseline for Incremental Learning","version":4},"cited_work":{"arxiv_id":"2407.15793","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.15793","snapshot_observed_at":"2026-06-30T00:14:04.039589Z","title":"Clip with generative latent replay: a strong baseline for incremental learning.arXiv preprint arXiv:2407.15793,","venue":null,"work_id":"25d6c1f9-1956-4884-b17d-4f399bbe5531","year":null},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"cited_paper":"/paper/2407.15793","citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:afd4308b567f42d7d0b8f8af30e74a9be4f2035e68f498b9a12ad912b5df96df","observation_id":"ce94efe3-23ec-4057-9b9d-82c2a6c70512","resolution":{"observed_at":"2026-06-30T00:14:04.041949Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:13:50.278588Z","title":"Domain Expan- sion in DNN-Based Acoustic Models for Robust Speech Recognition.2019 IEEE Automatic Speech Recognition and Understanding Workshop (ASRU), pp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:010015144edf8a4c5539c22b3a15aabadd16313949cdbe58c788f8d61dece661","observation_id":"f92579aa-69b9-48d0-8221-38b0b2c2eee8","resolution":{"observed_at":"2026-06-30T00:13:50.278588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17496","last_updated":"2025-05-23T05:50:14Z","snapshot_observed_at":"2026-08-13T14:24:27.406639Z","submitted_at":"2025-05-23T05:50:14Z","title":"Analyzing Mitigation Strategies for Catastrophic Forgetting in End-to-End Training of Spoken Language Models","version":1},"cited_work":{"arxiv_id":"2505.17496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17496","snapshot_observed_at":"2026-06-30T00:14:04.018407Z","title":"Analyzing mitigation strategies for catastrophic forgetting in end-to-end training of spoken language models","venue":null,"work_id":"a135e24e-433c-4cfa-a30c-c86b972f75f3","year":2025},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"cited_paper":"/paper/2505.17496","citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:9451fb17bdbadb242bb18ff54b3ef8d7c86105992ea564d0dbb4b44c7e7c1bdf","observation_id":"22bf6741-a9d7-4308-909d-fd4c133a05d0","resolution":{"observed_at":"2026-06-30T00:14:04.020962Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1073/pnas.1611835114","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T00:26:39.056637Z","title":"doi: 10.1073/pnas.1611835114","venue":"Proceedings of the National Academy of Sciences","work_id":"6c82f0ba-a185-45cb-a5eb-efcbacd90a09","year":2017},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:7ac299e7e9df08c2b6e973592101d7671834f23f6e383a5ae96609342ea924d2","observation_id":"b43e3b1b-912b-4041-bc5c-6c04571102cc","resolution":{"observed_at":"2026-06-30T00:14:03.857071Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T15:08:18.195064+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T15:08:18.195064+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T15:08:18.195064+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-46493-0","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Weinberger , editor =","venue":"Lecture notes in computer science","work_id":"09aa03fa-69c2-4b29-a286-c96e6895e095","year":2016},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:eb2b61f9a3345d9aebc8d1cf6497b6b29b8eb20a26149b31c0a61690bb23b105","observation_id":"1a3acc8e-2fce-460b-8468-745930089010","resolution":{"observed_at":"2026-06-30T00:14:03.853165Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-10T21:08:10.554159+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T21:08:10.554159+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06329","last_updated":"2024-06-10T14:46:07Z","snapshot_observed_at":"2026-08-12T23:46:24.632441Z","submitted_at":"2024-06-10T14:46:07Z","title":"A Parameter-efficient Language Extension Framework for Multilingual ASR","version":1},"cited_work":{"arxiv_id":"2406.06329","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06329","snapshot_observed_at":"2026-06-30T00:14:04.015308Z","title":"A Parameter-efficient Language Extension Framework for Multilingual ASR.ArXiv, abs/2406.06329, jun","venue":null,"work_id":"fec1ec04-cc5a-4327-b09e-450256156bae","year":null},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"cited_paper":"/paper/2406.06329","citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:b8f3363eb7cb4eb02676d7eabdd5ce0e3b99f11196d982f0a57422898fe9e23a","observation_id":"d3f6325f-5fc5-4917-9a72-97809fbae33f","resolution":{"observed_at":"2026-06-30T00:14:04.017247Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:13:50.278588Z","title":"and Xiao, Y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:7a0ec136117765a92c30b78db1236d400ead1b6239be6d4062523fc4f40226c7","observation_id":"749c9464-112a-4478-b543-8af0aa6a1ce7","resolution":{"observed_at":"2026-06-30T00:13:50.278588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14471","last_updated":"2024-12-06T18:22:32Z","snapshot_observed_at":"2026-08-13T11:02:48.602530Z","submitted_at":"2024-08-26T17:59:01Z","title":"A Practitioner's Guide to Continual Multimodal Pretraining","version":2},"cited_work":{"arxiv_id":"2408.14471","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14471","snapshot_observed_at":"2026-07-04T09:49:44.368193Z","title":"A practitioner’s guide to continual multimodal pretraining","venue":null,"work_id":"589ac5a2-9e36-4f2f-98bf-ae1567cddea6","year":2024},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"cited_paper":"/paper/2408.14471","citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:832d74432120add69341b6b68311af7614448ca53de57778e601cfd998059828","observation_id":"f3362d18-bfaf-4b26-9716-da4c314b9e6a","resolution":{"observed_at":"2026-06-30T00:14:04.027840Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.05543","last_updated":"2026-04-20T10:33:45Z","snapshot_observed_at":"2026-08-07T19:08:48.898922Z","submitted_at":"2026-01-09T05:51:56Z","title":"Closing the Modality Reasoning Gap for Speech Large Language Models","version":2},"cited_work":{"arxiv_id":"2601.05543","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.05543","snapshot_observed_at":"2026-07-03T01:37:30.611503Z","title":"Closing the Modality Reasoning Gap for Speech Large Language Models","venue":"cs.CL","work_id":"952409f6-737a-4ba4-a626-821db6d76ff8","year":2026},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"cited_paper":"/paper/2601.05543","citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:933aa5284ccf232edd088270e14b1540779869e8ff757356ec720b6d98d2accb","observation_id":"c318cf85-9af5-4ef0-9fa1-ef90167007e7","resolution":{"observed_at":"2026-06-30T00:14:04.038250Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.14930","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:14:04.007360Z","title":"Cross-modal knowledge distillation for speech large language models","venue":null,"work_id":"88c444c2-91ae-4319-9827-bf83a57763ee","year":2025},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:eee3ee87e21a2e1652e343a472c0fe93278a4c8b8e97483ed78b083ba8b54fd5","observation_id":"e8281b3c-0ff3-44a4-925c-32bd97ae5118","resolution":{"observed_at":"2026-06-30T00:14:04.009657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10680","last_updated":"2024-08-20T09:31:59Z","snapshot_observed_at":"2026-08-14T04:47:42.028273Z","submitted_at":"2024-08-20T09:31:59Z","title":"Towards Rehearsal-Free Multilingual ASR: A LoRA-based Case Study on Whisper","version":1},"cited_work":{"arxiv_id":"2408.10680","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.10680","snapshot_observed_at":"2026-06-30T00:14:04.032908Z","title":"Adapting where it matters: Depth-aware adaptation for efficient multilingual speech recognition in low-resource languages","venue":null,"work_id":"7fb5f874-13d0-4fa7-937d-022bc3c68f67","year":2026},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"cited_paper":"/paper/2408.10680","citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:2a4503983ed2844bbf7d85d5ba7e7ed81f1c8e5bc211d188268acacd7ca0a19c","observation_id":"5418468f-b99b-4f76-ba52-c2de851dd59a","resolution":{"observed_at":"2026-06-30T00:14:04.035066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:13:50.278588Z","title":"S., and Lee, H.-y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:704805ea59f6580839f4ba0a6f35d1a5f967a22dfe20c34a5b72f01a6d3655a2","observation_id":"05f3fa04-a993-43e4-977c-7447cd357754","resolution":{"observed_at":"2026-06-30T00:13:50.278588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:13:50.278588Z","title":"To- wards Lifelong Learning of Multilingual Text-to-Speech Synthesis.ICASSP 2022 - 2022 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:64a0b2f4253691b0b1c1cfa2d23ea7ce73d68c4cd2882295d762be4b14dd4386","observation_id":"5292192d-5652-4449-bd9b-310a82a1f76d","resolution":{"observed_at":"2026-06-30T00:13:50.278588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07875","last_updated":"2025-01-14T06:33:40Z","snapshot_observed_at":"2026-08-15T15:49:44.539730Z","submitted_at":"2025-01-14T06:33:40Z","title":"Continual Learning with Embedding Layer Surgery and Task-wise Beam Search using Whisper","version":1},"cited_work":{"arxiv_id":"2501.07875","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.07875","snapshot_observed_at":"2026-06-30T00:14:04.029329Z","title":"C., Yip, J., and Siong, C","venue":null,"work_id":"fbaf21ec-4131-4e52-a777-b257dd92929a","year":null},"citing_paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T00:13:50.278588Z"},"links":{"cited_paper":"/paper/2501.07875","citing_paper":"/paper/2605.24863"},"observation_digest":"sha256:fd457d5fe11ab9d344e96c907def07fd7e0ce56ac89e5111d095b4d62800d9c1","observation_id":"84305c98-a1c1-4164-bd2c-6870348b1e64","resolution":{"observed_at":"2026-06-30T00:14:04.031585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.24863","last_updated":"2026-05-29T01:13:17Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T19:58:36.942630Z","submitted_at":"2026-05-24T04:46:30Z","title":"Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":5,"verified_exact":11,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2605.24863."}