{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:XS6TBDEXYPGJGJCOASEP3CHUKV","short_pith_number":"pith:XS6TBDEX","schema_version":"1.0","canonical_sha256":"bcbd308c97c3cc93244e0488fd88f45541a0a9bf9dfed3881a148d2b02648e8c","source":{"kind":"arxiv","id":"2502.04469","version":2},"attestation_state":"computed","paper":{"title":"Ask and Remember: A Questions-Only Replay Strategy for Continual Visual Question Answering","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.CV","authors_text":"Enzo Tartaglione, Imad Eddine Marouf, Joost Van De Weijer, Stephane Lathuiliere","submitted_at":"2025-02-06T19:37:43Z","abstract_excerpt":"Continual Learning in Visual Question Answering (VQACL) requires models to acquire new visual-linguistic skills (plasticity) while preserving previously learned knowledge (stability). The inherent multimodality of VQACL exacerbates this challenge, as models must balance stability across visual and textual domains while adapting to novel objects and reasoning tasks. Existing methods, primarily designed for unimodal settings, often fall short in addressing this dual requirement. In this work, we present QUestion-only replay with Attention Distillation (QUAD), a novel approach for VQACL that leve"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2502.04469","kind":"arxiv","version":2},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CV","submitted_at":"2025-02-06T19:37:43Z","cross_cats_sorted":["cs.AI"],"title_canon_sha256":"ac1f3309ef863de5ed851909a6a4807cdf4146a1d2fd9dd5102bcc122b00ecb4","abstract_canon_sha256":"0742713f38eb2b932d3763b96bee3bafa2dfbeeff52b4ce59a4f8ee5e70cec81"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:44:00.931750Z","signature_b64":"g+F0+W52IlXdyyfJx0ksq4gm3GP1cKlkdyw1w81V5jmG5jZj3uZ3ekXQk4FgRASAmVQZ7Snt0ThBVWwx8iyxDQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"bcbd308c97c3cc93244e0488fd88f45541a0a9bf9dfed3881a148d2b02648e8c","last_reissued_at":"2026-07-05T11:44:00.931262Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:44:00.931262Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Ask and Remember: A Questions-Only Replay Strategy for Continual Visual Question Answering","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.CV","authors_text":"Enzo Tartaglione, Imad Eddine Marouf, Joost Van De Weijer, Stephane Lathuiliere","submitted_at":"2025-02-06T19:37:43Z","abstract_excerpt":"Continual Learning in Visual Question Answering (VQACL) requires models to acquire new visual-linguistic skills (plasticity) while preserving previously learned knowledge (stability). The inherent multimodality of VQACL exacerbates this challenge, as models must balance stability across visual and textual domains while adapting to novel objects and reasoning tasks. Existing methods, primarily designed for unimodal settings, often fall short in addressing this dual requirement. In this work, we present QUestion-only replay with Attention Distillation (QUAD), a novel approach for VQACL that leve"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2502.04469","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2502.04469/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2502.04469","created_at":"2026-07-05T11:44:00.931323+00:00"},{"alias_kind":"arxiv_version","alias_value":"2502.04469v2","created_at":"2026-07-05T11:44:00.931323+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2502.04469","created_at":"2026-07-05T11:44:00.931323+00:00"},{"alias_kind":"pith_short_12","alias_value":"XS6TBDEXYPGJ","created_at":"2026-07-05T11:44:00.931323+00:00"},{"alias_kind":"pith_short_16","alias_value":"XS6TBDEXYPGJGJCO","created_at":"2026-07-05T11:44:00.931323+00:00"},{"alias_kind":"pith_short_8","alias_value":"XS6TBDEX","created_at":"2026-07-05T11:44:00.931323+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":4,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.23063","citing_title":"Attention-Spectrum Regularization for Replay-Free Continual Multimodal LLMs","ref_index":15,"is_internal_anchor":false},{"citing_arxiv_id":"2607.02010","citing_title":"InduceKV: Fixed-Footprint Continual Adaptation of Multimodal LLMs via Inducing KV Memories","ref_index":123,"is_internal_anchor":false},{"citing_arxiv_id":"2508.04227","citing_title":"Continual Learning for VLMs: A Survey and Taxonomy Beyond Forgetting","ref_index":83,"is_internal_anchor":false},{"citing_arxiv_id":"2604.14779","citing_title":"AIM: Asymmetric Information Masking for Visual Question Answering Continual Learning","ref_index":39,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/XS6TBDEXYPGJGJCOASEP3CHUKV","json":"https://pith.science/pith/XS6TBDEXYPGJGJCOASEP3CHUKV.json","graph_json":"https://pith.science/api/pith-number/XS6TBDEXYPGJGJCOASEP3CHUKV/graph.json","events_json":"https://pith.science/api/pith-number/XS6TBDEXYPGJGJCOASEP3CHUKV/events.json","paper":"https://pith.science/paper/XS6TBDEX"},"agent_actions":{"view_html":"https://pith.science/pith/XS6TBDEXYPGJGJCOASEP3CHUKV","download_json":"https://pith.science/pith/XS6TBDEXYPGJGJCOASEP3CHUKV.json","view_paper":"https://pith.science/paper/XS6TBDEX","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2502.04469&json=true","fetch_graph":"https://pith.science/api/pith-number/XS6TBDEXYPGJGJCOASEP3CHUKV/graph.json","fetch_events":"https://pith.science/api/pith-number/XS6TBDEXYPGJGJCOASEP3CHUKV/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/XS6TBDEXYPGJGJCOASEP3CHUKV/action/timestamp_anchor","attest_storage":"https://pith.science/pith/XS6TBDEXYPGJGJCOASEP3CHUKV/action/storage_attestation","attest_author":"https://pith.science/pith/XS6TBDEXYPGJGJCOASEP3CHUKV/action/author_attestation","sign_citation":"https://pith.science/pith/XS6TBDEXYPGJGJCOASEP3CHUKV/action/citation_signature","submit_replication":"https://pith.science/pith/XS6TBDEXYPGJGJCOASEP3CHUKV/action/replication_record"}},"created_at":"2026-07-05T11:44:00.931323+00:00","updated_at":"2026-07-05T11:44:00.931323+00:00"}