{"as_of":"2026-08-09T15:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:450014df0f080b0dcd289d8e927eebb935b2dd0bb7ff71ba0b45b6111c11039f","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T23:37:28.784524Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.04098/citation-record","integrity":"/paper/2502.04098/integrity","json":"/paper/2502.04098/citation-record.json","paper":"/paper/2502.04098"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.557679Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.557679Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:566e2325b943d5338dde8c0df1c1f1e4550a5dfd9d05526702d4852e3f0f75fd","observation_id":"b411f066-004c-483f-b86f-ebd22c159a1d","resolution":{"observed_at":"2026-08-08T23:37:28.557679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.652251Z","title":"K., Ajanthan, T., and Torr, P","venue":null,"work_id":"78409497-a56b-4106-9554-ddd69b2e2308","year":2018},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.564176Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:ccf92ad5711b6a326d0f3c8d2bef7a87aad23ccfc9fb1012c980c038219e189f","observation_id":"b7368ab0-2287-4a27-8703-05c50ddd22fb","resolution":{"observed_at":"2026-08-08T23:37:29.657235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-08-06T12:38:03.720232Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09478","snapshot_observed_at":"2026-08-08T23:37:28.569150Z","title":"Minigpt-v2: large language model as a unified interface for vision-language multi-task learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.569150Z"},"links":{"cited_paper":"/paper/2310.09478","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:508a9f6a641a30333b28b58df722efbc1bd646ca9ec1611980175c07db2e14d6","observation_id":"205508cb-51bb-4310-a660-2e25087369b5","resolution":{"observed_at":"2026-08-08T23:37:28.569150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.574680Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.574680Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:2e117cf856900cd5cd91b87e640ce87a4aeebff9b54575bd8bcdbe5fb5d5e249","observation_id":"9b80ff9e-043f-4ab4-b2f7-2214f87f094a","resolution":{"observed_at":"2026-08-08T23:37:28.574680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.579417Z","title":"Can we edit multimodal large language models? In Bouamor, H., Pino, J., and Bali, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.579417Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:e784845fd0df513bc44cf22a116530aa1807270743e3b5c899695deea67a6837","observation_id":"a3a8ac91-99ce-41a2-9f91-71b6ae382a94","resolution":{"observed_at":"2026-08-08T23:37:28.579417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.584286Z","title":"E., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.584286Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:1be2fec18baffc460256411eb444dfa823b7a51e297aaaa985f05b3c6fba9ca1","observation_id":"1d713ecf-66d3-4242-a4ad-ad33d9547233","resolution":{"observed_at":"2026-08-08T23:37:28.584286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08696","last_updated":"2022-03-10T02:28:59Z","snapshot_observed_at":"2026-08-09T05:29:46.140161Z","submitted_at":"2021-04-18T03:38:26Z","title":"Knowledge Neurons in Pretrained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08696","snapshot_observed_at":"2026-08-08T23:37:28.589022Z","title":"Knowledge neurons in pretrained transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.589022Z"},"links":{"cited_paper":"/paper/2104.08696","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:252ead2e40d73c83737d61693fa064b97f0925eef37350776d650a7f612d2bbb","observation_id":"ad90ecaf-8733-4b6b-a5a6-b9ce7e557e6e","resolution":{"observed_at":"2026-08-08T23:37:28.589022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02210","last_updated":"2025-03-18T09:50:15Z","snapshot_observed_at":"2026-07-06T19:44:55.644262Z","submitted_at":"2024-11-04T16:04:59Z","title":"One VLM to Keep it Learning: Generation and Balancing for Data-free Continual Visual Question Answering","version":2},"cited_work":{"arxiv_id":"2411.02210","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.02210","snapshot_observed_at":"2026-08-08T23:37:29.241052Z","title":"One VLM to Keep it Learning: Generation and Balancing for Data-free Continual Visual Question Answering","venue":"cs.CV","work_id":"1521a511-f2bf-44c6-a7d9-fa3a6ec5b5c4","year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.594442Z"},"links":{"cited_paper":"/paper/2411.02210","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:821373512513a2c66ffca19e309c0dfa165e1cd0e97b90ccf97b2d2d2738ecc6","observation_id":"12dbc5e0-e4bb-4f2b-bc8c-25cfea4133bf","resolution":{"observed_at":"2026-08-08T23:37:29.246639Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.614679Z","title":"Toyota smarthome: Real-world activities of daily living","venue":null,"work_id":"e4c7d7e5-11e1-452f-a1b1-b94eb36f7cf2","year":2019},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.600068Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:9d7cf191aac387bc60ec73dadfa8d5d70421ff550917e4462cbb4ed059ec24fa","observation_id":"a7e3c7f8-c3bb-4da7-8a18-bc6d0d916d20","resolution":{"observed_at":"2026-08-08T23:37:29.619683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.599142Z","title":"A continual learning survey: Defying forgetting in classification tasks","venue":null,"work_id":"dc5f1d77-b6c6-490a-a3f5-bc602372bf0a","year":2021},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.604665Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:9cf6fa17fdb71cd9efe4d6bf5b9799e11f58aa959151976222a04d03e7397164","observation_id":"1e26982f-c1b1-407f-9f89-6b05cceb0f28","resolution":{"observed_at":"2026-08-08T23:37:29.604104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.216574Z","title":"Image N et: A large-scale hierarchical image database","venue":null,"work_id":"feaa6a67-4510-4844-8518-ac5de553c552","year":2009},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.609220Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:65867b52ac24c6db02a10780d59f8d7bc16fbab1c53afdacaa6034af123d3c77","observation_id":"99a4f794-781c-429c-8519-24ba08951087","resolution":{"observed_at":"2026-08-08T23:37:29.223428Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.583313Z","title":"Vlmevalkit: An open-source toolkit for evaluating large multi-modality models","venue":null,"work_id":"5d7514d1-57ae-4c8c-8d6a-114a5d4957a6","year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.614213Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:cd049157dbfc692841b8b36fd599bb73f42a72497a09fc4ff63dc15f0197a605","observation_id":"437c1faf-db40-43b4-9f87-ffda471c785d","resolution":{"observed_at":"2026-08-08T23:37:29.588345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.567461Z","title":"Calibrating higher-order statistics for few-shot class-incremental learning with pre-trained vision transformers","venue":null,"work_id":"0013663b-2f6f-4502-b7f1-3274e01bdb51","year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.619052Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:58c5b0e869afd43d978f63baeaf6ddff464087a94dafb116425443cadfc2cd60","observation_id":"ab323fa8-81b2-4ae0-976b-cb0a53b2844e","resolution":{"observed_at":"2026-08-08T23:37:29.572489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.551737Z","title":"Sensitivity-aware visual parameter-efficient fine-tuning","venue":null,"work_id":"499d6240-f9c5-4b8b-a16a-a2426ff48a7e","year":2023},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.623774Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:1cc403ec27f76e755185d7674fd2690f996b1a6f4cd10a5c62fc767370235895","observation_id":"46460233-240b-4fed-ae8a-d03fd6fc9434","resolution":{"observed_at":"2026-08-08T23:37:29.556818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16206","last_updated":"2023-11-27T15:04:48Z","snapshot_observed_at":"2026-08-08T00:39:51.098827Z","submitted_at":"2023-11-27T15:04:48Z","title":"Continual Instruction Tuning for Large Multimodal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16206","snapshot_observed_at":"2026-08-08T23:37:28.628380Z","title":"Continual instruction tuning for large multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.628380Z"},"links":{"cited_paper":"/paper/2311.16206","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:af284fc5512c25b627705ce103343f2936b3ee7cdd4b871a92fd539fbf08f074","observation_id":"4904d7d8-9b36-4b90-8fbc-a409f9e4a06b","resolution":{"observed_at":"2026-08-08T23:37:28.628380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.633129Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.633129Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:d09575aba99a116dd3dcce0d492970cf7a8be8bdae3fc63040c61193d8054b0e","observation_id":"52bbe0a8-4106-4f43-bcbb-01b51402724a","resolution":{"observed_at":"2026-08-08T23:37:28.633129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-08T23:37:28.637604Z","title":"J., Shen, Y., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.637604Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:154e1c6a25005b314a400ff8a51000afe7a6b2209d2420f748e6a4a3b3ffc8b2","observation_id":"808de7d4-7cdc-4e7f-baa8-d71e69274896","resolution":{"observed_at":"2026-08-08T23:37:28.637604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00947","last_updated":"2025-07-13T22:29:38Z","snapshot_observed_at":"2026-08-03T17:23:10.606578Z","submitted_at":"2024-12-01T19:46:22Z","title":"VisOnlyQA: Large Vision Language Models Still Struggle with Visual Perception of Geometric Information","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00947","snapshot_observed_at":"2026-08-08T23:37:28.642453Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.642453Z"},"links":{"cited_paper":"/paper/2412.00947","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:e98f3fd3fa41abcaecf9831b686ef8e1b010bd2ad29ab95048876ea54231543a","observation_id":"f7140633-96f6-4c00-9bee-71368dcfa5a6","resolution":{"observed_at":"2026-08-08T23:37:28.642453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.647516Z","title":"The hateful memes challenge: Detecting hate speech in multimodal memes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.647516Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:3bf7ed4889a6cc1e7155621e9eeaec55bfd4a167a1373e73f5be4abf6eba22d5","observation_id":"9aff4976-85c2-4df6-af12-8e057ccfb2b6","resolution":{"observed_at":"2026-08-08T23:37:28.647516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-08T23:37:28.652235Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.652235Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:d02faa96e0eb3762fbb5e6b490356c7e070688d2bcc4726350b3295039d91753","observation_id":"3ecb4bff-bfa8-4e3f-9493-bfa3226e66ed","resolution":{"observed_at":"2026-08-08T23:37:28.652235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.656933Z","title":"A., Milan, K., Quan, J., Ramalho, T., Grabska-Barwinska, A., et al","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.656933Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:4fde6cd0c467650b7aeb8bca7e986944f386acab0864d4e5d52e1c4e0db265fb","observation_id":"e2c43995-d03d-43f9-bcab-50f7fdb67387","resolution":{"observed_at":"2026-08-08T23:37:28.656933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.661387Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.661387Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:fdfd068c14c7d58cf5c66202b215088c5a56bc69d5ed33444cf58b6f4b1af51c","observation_id":"e1b66187-4c8f-46f0-9daa-302073cda715","resolution":{"observed_at":"2026-08-08T23:37:28.661387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.495788Z","title":null,"venue":null,"work_id":"4c37410f-4122-4f84-aa07-87dd9db49fe4","year":2023},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.665986Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:b8d5a10b7b348318cde2926ab413d4c71d8e52c3085d97d3ba8af01fd8ac0085","observation_id":"7000f9f8-4227-45f7-bc1f-03e19f81e2da","resolution":{"observed_at":"2026-08-08T23:37:29.500739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.480257Z","title":null,"venue":null,"work_id":"b3621e76-6599-4591-a76b-8a8b98c33d7a","year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.670694Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:676ed00293ae02f33adc3757ac68d078ac69549597b40f0eaf7b862a85dda2a4","observation_id":"a8aba2c3-a839-452c-8e2a-78f976404b99","resolution":{"observed_at":"2026-08-08T23:37:29.485074Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.675423Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.675423Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:eee046985762ed5cebe2eaa32e9b174aed1f581c4d2571d09324abff14b6d09e","observation_id":"3ebb2a6e-b89a-42be-8f74-d23d0f296d83","resolution":{"observed_at":"2026-08-08T23:37:28.675423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.680284Z","title":"and Ranzato, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.680284Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:d2321ebc9a1a6d2409e40e6aee2b051db0183ef5ba0cec3b9588ac863dc022ff","observation_id":"15cf87dc-2330-406a-97b4-9430532e50a2","resolution":{"observed_at":"2026-08-08T23:37:28.680284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-08T23:37:28.684871Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.684871Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:1fbf8aae3ff2f0315b5f444de5d70aa4ce4099eead33e9d31fd2e5e077a60fab","observation_id":"2e38c71e-a4c0-4379-8644-fb5d557d8cd4","resolution":{"observed_at":"2026-08-08T23:37:28.684871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.442541Z","title":"Fine-grained visual classification of aircraft","venue":null,"work_id":"c004d616-7fea-4f9b-9ab8-e8d86f46d3d1","year":2013},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.690073Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:3d1fdc2c015b9db738ff657088d84c7111f052fc8ccf8d7d2ce7180225cdd6be","observation_id":"11193832-bcea-4d1e-8294-8b9cc14f664f","resolution":{"observed_at":"2026-08-08T23:37:29.448646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.426542Z","title":"Locating and editing factual associations in gpt","venue":null,"work_id":"e27f4efd-a8db-4331-9a10-227d94d2282f","year":2022},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.694680Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:c95cf0f4483e564865ef4ce11153e5ca3e132b99233d96b23e3e24f44b9fe01f","observation_id":"73127fd7-f589-4d6c-9e6e-7db05cfd1e32","resolution":{"observed_at":"2026-08-08T23:37:29.431309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.411615Z","title":null,"venue":null,"work_id":"4a58b6fd-f7cc-4101-8f45-c4c7898fd540","year":2022},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.699369Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:8baf46a526826e1c397dd26950e5af0c15a8a6cca06cfa2ec167a1c104c3cdb6","observation_id":"ced039a4-2c81-4356-be2a-e5ff409f2b8e","resolution":{"observed_at":"2026-08-08T23:37:29.416406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.396142Z","title":"O., Aljundi, R., and Turner, R","venue":null,"work_id":"0110b2e4-5604-42a8-acfe-07bf7179d476","year":2023},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.703889Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:f14867158354c95d16f3e756aee01167686c37cf8711275556df96f4a2446588","observation_id":"d5f068ed-d12f-4aec-9a6c-4ee73a7189f0","resolution":{"observed_at":"2026-08-08T23:37:29.400905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.380211Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":"c25094cd-87ed-475d-905c-31896b14481b","year":2019},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.708538Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:b52252686359f65d1ce3b71699ba10c36f6b0a56927df15419ea94c4d6536bb7","observation_id":"d0ac77f9-80d4-4459-bb00-0069f311796b","resolution":{"observed_at":"2026-08-08T23:37:29.385261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.364633Z","title":"Fi LM : Visual reasoning with a general conditioning layer","venue":null,"work_id":"c3ab720f-139f-460a-bc3f-f10904a2939b","year":2018},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.713086Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:6523164f4913a9b83594ee7665a82fe897dc0c4f7994c9a48a996aef756310e4","observation_id":"13ff128c-35eb-417d-bae6-aea5b95420d9","resolution":{"observed_at":"2026-08-08T23:37:29.369522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.717658Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.717658Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:d38646555699e6552c79e6360abde39fb8e827180c8335d80b0944204cc204ba","observation_id":"821285a8-3970-402a-80ca-c3f3a9b6c953","resolution":{"observed_at":"2026-08-08T23:37:28.717658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.339074Z","title":"Editable neural networks","venue":null,"work_id":"2bb6ad84-681f-4965-a376-8f7f0bb54177","year":2020},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.722253Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:0f7d1528c2a38170149482b9a548b02a49021f7b4b4d43498ba26ca1eca5700b","observation_id":"a1d96b75-ee65-4eac-b0e1-cd16db57bf50","resolution":{"observed_at":"2026-08-08T23:37:29.344077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19925","last_updated":"2025-08-13T02:38:33Z","snapshot_observed_at":"2026-07-06T19:39:59.961070Z","submitted_at":"2024-10-25T18:50:40Z","title":"Improving Multimodal Large Language Models Using Continual Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19925","snapshot_observed_at":"2026-08-08T23:37:28.727210Z","title":"Y., Shrestha, R., and Kanan, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.727210Z"},"links":{"cited_paper":"/paper/2410.19925","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:a8a7c14d6424b262eaad6655fd9151fe534cb9a2581664c6fa46b576ec3d0046","observation_id":"c7e6b685-9dc2-4a6e-abc3-d5ab741ae19e","resolution":{"observed_at":"2026-08-08T23:37:28.727210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.732177Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.732177Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:02b2bc7ec5f1fdc150e50a2edb793a2dfd9ab1787450df6a299c63b2eddce432","observation_id":"381b2867-348b-4b13-9332-b147f75c25de","resolution":{"observed_at":"2026-08-08T23:37:28.732177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.736877Z","title":"Eyes wide shut? exploring the visual shortcomings of multimodal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.736877Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:aba34e8e7d3dcc7baa987433679b280ea678dd1f524d403846904ba04f2a87b0","observation_id":"286d6ce1-1294-45ac-a0b2-7d687ced9179","resolution":{"observed_at":"2026-08-08T23:37:28.736877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-08T23:37:28.741658Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.741658Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:8213370ac33a8dcca63f91b2acbd2aa63048c7e088c9b44954be8f7b2b0fb319","observation_id":"bfdad46e-c82a-463f-b0c5-15b38c583d36","resolution":{"observed_at":"2026-08-08T23:37:28.741658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:28.746586Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.746586Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:04ed4024bf194e210ca00a6057c081aa943712c3530e24c14c14ca155fdfd1d1","observation_id":"67388035-7f04-4bc6-9737-d8b5b6773d00","resolution":{"observed_at":"2026-08-08T23:37:28.746586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11908","last_updated":"2024-03-28T13:16:50Z","snapshot_observed_at":"2026-07-06T16:50:02.155961Z","submitted_at":"2023-11-20T16:40:29Z","title":"Continual Learning: Applications and the Road Forward","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11908","snapshot_observed_at":"2026-08-08T23:37:28.751073Z","title":"L., H \\\"u llermeier, E., Kanan, C., Kudithipudi, D., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.751073Z"},"links":{"cited_paper":"/paper/2311.11908","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:bdabbea7452e8ae16021f095ff4b597a2b250fa9506b4b94526c974fd7c3de37","observation_id":"41a86b20-b36a-4ba1-a118-6bca4b5ea0c0","resolution":{"observed_at":"2026-08-08T23:37:28.751073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-08T23:37:28.755944Z","title":"Qwen2-vl: Enhancing vision-language model's perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.755944Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:2354ca823b55c413e7f51f49d6ccab0e0b3141495cde4c7cb9821edaff70768d","observation_id":"48be9753-8012-41d6-8cb3-11b85084cde9","resolution":{"observed_at":"2026-08-08T23:37:28.755944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11497","last_updated":"2024-11-02T04:58:15Z","snapshot_observed_at":"2026-08-04T23:23:42.517974Z","submitted_at":"2024-03-18T06:04:02Z","title":"A Sober Look at the Robustness of CLIPs to Spurious Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11497","snapshot_observed_at":"2026-08-08T23:37:28.760647Z","title":"Do clips always generalize better than imagenet models? arXiv preprint arXiv:2403.11497, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.760647Z"},"links":{"cited_paper":"/paper/2403.11497","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:df160abc6be0d00c2fdc9f7ead55ef88f271cb1d88c366693114a568faac5c33","observation_id":"3722725d-07ae-43e4-b161-2d0b017f0137","resolution":{"observed_at":"2026-08-08T23:37:28.760647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01364","last_updated":"2024-02-07T07:14:39Z","snapshot_observed_at":"2026-08-04T18:35:41.659861Z","submitted_at":"2024-02-02T12:34:09Z","title":"Continual Learning for Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01364","snapshot_observed_at":"2026-08-08T23:37:28.765591Z","title":"Continual learning for large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.765591Z"},"links":{"cited_paper":"/paper/2402.01364","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:e515e5971e63ba6305f96ab61145f725e580fdabf1507748e9f966bfb14b0d78","observation_id":"366b7fd0-d338-4d61-8664-b8213d15b214","resolution":{"observed_at":"2026-08-08T23:37:28.765591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-07-06T15:05:16.471478Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10512","snapshot_observed_at":"2026-08-08T23:37:28.770261Z","title":"Adalora: Adaptive budget allocation for parameter-efficient fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.770261Z"},"links":{"cited_paper":"/paper/2303.10512","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:baceae60b2cf5bd7d5b9dae2e833a248f96faad3b01bfdd3da1ebae351d75532","observation_id":"11879a5c-9de3-4ccd-ac02-a99259e75e93","resolution":{"observed_at":"2026-08-08T23:37:28.770261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:37:29.292246Z","title":"Overcoming generic knowledge loss with selective parameter update","venue":null,"work_id":"91f1175d-ada7-4a2d-bd3d-16178ee9e3ae","year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.775113Z"},"links":{"citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:9a85d057fe747efb5ba13b24a9889817a5326456df010a02ac46678d0c47b620","observation_id":"aeac0f0c-c641-41eb-b067-5820a2cce20e","resolution":{"observed_at":"2026-08-08T23:37:29.297416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02175","last_updated":"2024-11-04T15:34:30Z","snapshot_observed_at":"2026-07-06T19:44:51.287226Z","submitted_at":"2024-11-04T15:34:30Z","title":"SAFE: Slow and Fast Parameter-Efficient Tuning for Continual Learning with Pre-Trained Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02175","snapshot_observed_at":"2026-08-08T23:37:28.779843Z","title":"Safe: Slow and fast parameter-efficient tuning for continual learning with pre-trained models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.779843Z"},"links":{"cited_paper":"/paper/2411.02175","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:da99a7d63295e060b0ea8cacfee3d90ac981883a86a263b00eb1d172670ec56b","observation_id":"95bde1aa-9729-400c-84ae-db35fdc40d6c","resolution":{"observed_at":"2026-08-08T23:37:28.779843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-08T23:37:28.784524Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T23:37:28.784524Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2502.04098"},"observation_digest":"sha256:40c76f4ae6c96766277f4da42e8a4b0817c7fa901080fdac3dca38d43aa3d765","observation_id":"055b9654-c5a8-434e-9398-21a45f8b6937","resolution":{"observed_at":"2026-08-08T23:37:28.784524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.04098","last_updated":"2025-02-07T13:35:01Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T23:29:54.545582Z","submitted_at":"2025-02-06T14:20:55Z","title":"Efficient Few-Shot Continual Learning in Vision-Language Models"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":2,"verified_fuzzy":13},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2502.04098."}