{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2023:JUVXYOO5WOCDOMTYMWD5S4TEJB","short_pith_number":"pith:JUVXYOO5","schema_version":"1.0","canonical_sha256":"4d2b7c39ddb3843732786587d97264487c267e644774652087acf2b3db27784b","source":{"kind":"arxiv","id":"2310.05644","version":1},"attestation_state":"computed","paper":{"title":"Diagnosing Catastrophe: Large parts of accuracy loss in continual learning can be accounted for by readout misalignment","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.CV"],"primary_cat":"cs.LG","authors_text":"Daniel Anthes, Peter K\\\"onig, Sushrut Thorat, Tim C. Kietzmann","submitted_at":"2023-10-09T11:57:46Z","abstract_excerpt":"Unlike primates, training artificial neural networks on changing data distributions leads to a rapid decrease in performance on old tasks. This phenomenon is commonly referred to as catastrophic forgetting. In this paper, we investigate the representational changes that underlie this performance decrease and identify three distinct processes that together account for the phenomenon. The largest component is a misalignment between hidden representations and readout layers. Misalignment occurs due to learning on additional tasks and causes internal representations to shift. Representational geom"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2310.05644","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.LG","submitted_at":"2023-10-09T11:57:46Z","cross_cats_sorted":["cs.CV"],"title_canon_sha256":"c5c18be49bbd36cc643db1de7323b063ca42b03a27abbb26689328c651271f42","abstract_canon_sha256":"addd05567574afac5c7827660dbc1d4f58dbd28c1a1b4dcc6523b51a9dff1f79"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T06:58:48.078950Z","signature_b64":"l9wCdkNuIopMnTBv8N31r4Hr9Hm2jXp2wAkS3e5Vf0G630e5pr26MlHoiPFr9PZzrbmLH7BeVlfJjHDZD6ZDAA==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"4d2b7c39ddb3843732786587d97264487c267e644774652087acf2b3db27784b","last_reissued_at":"2026-07-05T06:58:48.078517Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T06:58:48.078517Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Diagnosing Catastrophe: Large parts of accuracy loss in continual learning can be accounted for by readout misalignment","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.CV"],"primary_cat":"cs.LG","authors_text":"Daniel Anthes, Peter K\\\"onig, Sushrut Thorat, Tim C. Kietzmann","submitted_at":"2023-10-09T11:57:46Z","abstract_excerpt":"Unlike primates, training artificial neural networks on changing data distributions leads to a rapid decrease in performance on old tasks. This phenomenon is commonly referred to as catastrophic forgetting. In this paper, we investigate the representational changes that underlie this performance decrease and identify three distinct processes that together account for the phenomenon. The largest component is a misalignment between hidden representations and readout layers. Misalignment occurs due to learning on additional tasks and causes internal representations to shift. Representational geom"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2310.05644","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2310.05644/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2310.05644","created_at":"2026-07-05T06:58:48.078575+00:00"},{"alias_kind":"arxiv_version","alias_value":"2310.05644v1","created_at":"2026-07-05T06:58:48.078575+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2310.05644","created_at":"2026-07-05T06:58:48.078575+00:00"},{"alias_kind":"pith_short_12","alias_value":"JUVXYOO5WOCD","created_at":"2026-07-05T06:58:48.078575+00:00"},{"alias_kind":"pith_short_16","alias_value":"JUVXYOO5WOCDOMTY","created_at":"2026-07-05T06:58:48.078575+00:00"},{"alias_kind":"pith_short_8","alias_value":"JUVXYOO5","created_at":"2026-07-05T06:58:48.078575+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":1,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2608.07436","citing_title":"Post-Grokking Collapse at the Representation-Readout Interface in Muon-Trained Transformers","ref_index":1,"is_internal_anchor":true}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/JUVXYOO5WOCDOMTYMWD5S4TEJB","json":"https://pith.science/pith/JUVXYOO5WOCDOMTYMWD5S4TEJB.json","graph_json":"https://pith.science/api/pith-number/JUVXYOO5WOCDOMTYMWD5S4TEJB/graph.json","events_json":"https://pith.science/api/pith-number/JUVXYOO5WOCDOMTYMWD5S4TEJB/events.json","paper":"https://pith.science/paper/JUVXYOO5"},"agent_actions":{"view_html":"https://pith.science/pith/JUVXYOO5WOCDOMTYMWD5S4TEJB","download_json":"https://pith.science/pith/JUVXYOO5WOCDOMTYMWD5S4TEJB.json","view_paper":"https://pith.science/paper/JUVXYOO5","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2310.05644&json=true","fetch_graph":"https://pith.science/api/pith-number/JUVXYOO5WOCDOMTYMWD5S4TEJB/graph.json","fetch_events":"https://pith.science/api/pith-number/JUVXYOO5WOCDOMTYMWD5S4TEJB/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/JUVXYOO5WOCDOMTYMWD5S4TEJB/action/timestamp_anchor","attest_storage":"https://pith.science/pith/JUVXYOO5WOCDOMTYMWD5S4TEJB/action/storage_attestation","attest_author":"https://pith.science/pith/JUVXYOO5WOCDOMTYMWD5S4TEJB/action/author_attestation","sign_citation":"https://pith.science/pith/JUVXYOO5WOCDOMTYMWD5S4TEJB/action/citation_signature","submit_replication":"https://pith.science/pith/JUVXYOO5WOCDOMTYMWD5S4TEJB/action/replication_record"}},"created_at":"2026-07-05T06:58:48.078575+00:00","updated_at":"2026-07-05T06:58:48.078575+00:00"}