{"as_of":"2026-08-08T10:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2bf0f823f019c7cf837be144ee56ae73914d65340b7f97cb7c4ee8820c802671","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:18:45.684227Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T11:29:29.185783Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19455","snapshot_observed_at":"2026-08-02T11:29:29.185783Z","title":"Mm-prompt: Cross-modal prompt tuning for continual visual question answering.arXiv preprint arXiv:2505.19455, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22603","last_updated":"2026-06-12T16:52:12Z","snapshot_observed_at":"2026-08-05T17:51:52.102623Z","submitted_at":"2026-06-12T16:52:12Z","title":"Group Preference Collapse in Personalized Multimodal Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T11:29:29.185783Z"},"links":{"cited_paper":"/paper/2505.19455","citing_paper":"/paper/2607.22603"},"observation_digest":"sha256:dfdfbd1c3a704516daa407d4bb12c3da1c8efdfc73ee58146f6f93be0a4ced02","observation_id":"2d7753f2-fd46-4f6c-a6d5-04b682a174bb","resolution":{"observed_at":"2026-08-02T11:29:29.185783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19455/citation-record","integrity":"/paper/2505.19455/integrity","json":"/paper/2505.19455/citation-record.json","paper":"/paper/2505.19455"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:58.194615Z","title":"VLC-BERT: Visual question answering with contextualized commonsense knowledge","venue":null,"work_id":"a9ca24cb-0464-420e-b6b2-20039f9737cb","year":2023},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:39.472572Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:75527dae088ff7c55027ea5ddf288ac44f5bca254a35fb81488f2146911d1031","observation_id":"e6ae922a-bab8-4215-b0b6-9dfe69934b24","resolution":{"observed_at":"2026-08-07T14:18:58.338712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:57.917800Z","title":"Align before fuse: Vision and language representation learning with momen- tum distillation","venue":null,"work_id":"13a88132-554d-4a3f-8276-a8c2ef3eddac","year":2021},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:39.629437Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:5b9c2ddfb96f2f24031fbb76d03c18aa7bd48b38ef5caa42fde2befeb55ba87d","observation_id":"ac9a5d60-9325-4594-9b14-5daab540db17","resolution":{"observed_at":"2026-08-07T14:18:58.045224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:57.632305Z","title":"Vqacl: A novel visual question answering continual learning setting","venue":null,"work_id":"dea962d7-4f08-470e-9241-67e4e4c0d0aa","year":2023},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:39.809754Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:d812059c6f1783648e79a39fe40f7cdd07e4668cbc33e1878a137c804425a640","observation_id":"6fe75be5-1eb4-48a5-84e7-29fca135b16d","resolution":{"observed_at":"2026-08-07T14:18:57.760674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19297","last_updated":"2024-06-27T16:12:57Z","snapshot_observed_at":"2026-07-06T18:38:00.379225Z","submitted_at":"2024-06-27T16:12:57Z","title":"Enhancing Continual Learning in Visual Question Answering with Modality-Aware Feature Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19297","snapshot_observed_at":"2026-08-07T14:18:39.958714Z","title":"En- hancing continual learning in visual question answering with modality-aware feature distilla- tion.arXiv preprint arXiv:2406.19297, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:39.958714Z"},"links":{"cited_paper":"/paper/2406.19297","citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:6f04fbc61fcc30c483b93626ce41a32ee8d411150525dbd797e0c582806896cd","observation_id":"36d15d62-f440-4a59-bac7-880688c382d0","resolution":{"observed_at":"2026-08-07T14:18:39.958714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:57.319262Z","title":"Decouple before interact: Multi-modal prompt learning for continual visual question answering","venue":null,"work_id":"ce0b5ebc-41d0-4fd8-8b7f-cb0993ef50d1","year":2023},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:40.068963Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:0df084080506ca32e07cd43d928f84966819bbbbe3bd97672906cafd9f25589c","observation_id":"9d597ad1-f91c-424b-8710-be8908819f64","resolution":{"observed_at":"2026-08-07T14:18:57.445456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:58.524071Z","title":"RE- VIVE: Regional visual representation matters in knowledge-based visual question answering","venue":null,"work_id":"112b514c-0493-4dc1-b13c-482be6d6acd5","year":2022},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:40.219348Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:ec25ed33d96e9d22712379cfc3339429032074504d2736eff757f89c89762983","observation_id":"cd25b4d6-6e6c-471a-b13d-58b5c22cbb64","resolution":{"observed_at":"2026-08-07T14:18:58.667094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:57.064290Z","title":"Symbolic replay: Scene graph as prompt for continual learning on VQA task","venue":null,"work_id":"ea4aa7e6-6f69-4fe9-a3d8-60560d9046c6","year":2023},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:40.380500Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:bc75fd77f9ac889bf66d0b9baceb5684e845f19879172e831e5bd255d0a3721e","observation_id":"8c5b0a7f-e4cd-4b7c-999a-0345ea4cb14d","resolution":{"observed_at":"2026-08-07T14:18:57.179424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11742","last_updated":"2024-08-21T16:07:49Z","snapshot_observed_at":"2026-07-06T19:04:09.389583Z","submitted_at":"2024-08-21T16:07:49Z","title":"CluMo: Cluster-based Modality Fusion Prompt for Continual Learning in Visual Question Answering","version":1},"cited_work":{"arxiv_id":"2408.11742","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.11742","snapshot_observed_at":"2026-08-07T14:18:46.008492Z","title":"CluMo: Cluster-based Modality Fusion Prompt for Continual Learning in Visual Question Answering","venue":"cs.CV","work_id":"0a13cbf5-f0a3-4790-b532-2f6ea6dcd884","year":2024},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:40.495264Z"},"links":{"cited_paper":"/paper/2408.11742","citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:901869cdb1d9e858291576ed4b453dcc73cb36a6b4889aedad617a07d90c012c","observation_id":"9913f3ed-6ddc-4afe-82ca-58238da31f9c","resolution":{"observed_at":"2026-08-07T14:18:46.155924Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:56.771012Z","title":"DualPrompt: Complementary prompting for rehearsal-free continual learning","venue":null,"work_id":"b7fc7af8-26dd-400a-9544-edc659c3098f","year":2022},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:40.652713Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:d43821789032212ddfb6942be270a4be7c4007de441caeaa10781704dc0452c2","observation_id":"3f726f8c-57e2-4b33-8db8-3ed788348b82","resolution":{"observed_at":"2026-08-07T14:18:56.940890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:56.496573Z","title":"Learning to prompt for continual learning","venue":null,"work_id":"2fc16676-2747-4492-9220-11a3a88f3b80","year":2022},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:40.777953Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:356f00fe87f64e8670d10669bb5e1d5c35c765dfb921b65ca79dcdefad4d391e","observation_id":"43e4801c-2209-4de4-8d8f-b00eaea56e1f","resolution":{"observed_at":"2026-08-07T14:18:56.599667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:56.245084Z","title":"CODA-Prompt: Contin- ual decomposed attention-based prompting for rehearsal-free continual learning","venue":null,"work_id":"bc4bdd51-46ed-4887-8f0f-bbc2ff0f1cf4","year":2023},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:40.943821Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:76615939b89971a4c61f18468be98355b189154a4e13cb455ed7215fa961a682","observation_id":"6f9b46ce-0b9f-4b0c-89ae-6c2668842733","resolution":{"observed_at":"2026-08-07T14:18:56.343115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:55.917832Z","title":"Semantic residual prompts for continual learning","venue":null,"work_id":"38412c11-2c5b-43b7-a546-9ec31f475d6b","year":2024},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:41.055708Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:9d515c3cc9070eba1ab6398e4f2803a00c8622313462f606567a46e1a550706d","observation_id":"22dffaf8-fe08-4f55-aee0-fb0b0bd2dddf","resolution":{"observed_at":"2026-08-07T14:18:56.052264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:55.473175Z","title":"Multi-domain multi- task rehearsal for lifelong learning","venue":null,"work_id":"2ef319e1-b5c0-4d1c-baf4-f9a5cb019507","year":2021},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:41.235906Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:f35d110ed22e31a3e11f632c775b5a5d9ec738ba251e0fb881fd3b710856ac6d","observation_id":"6e32edd3-7d65-4cff-867b-0aad9e513f3d","resolution":{"observed_at":"2026-08-07T14:18:55.799111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:55.177545Z","title":"Exploring example influence in continual learning","venue":null,"work_id":"11d153a7-d61c-4947-b507-15a91144ba5c","year":2022},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:41.384164Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:1f597785a12a9385ceda6f3a3a150a4543328a5a8fa787b03878fd28f8ceb9f6","observation_id":"ab5d9594-1fa3-4350-9a12-5db1c8d4b6bc","resolution":{"observed_at":"2026-08-07T14:18:55.291288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:54.875055Z","title":"Measuring asymmetric gradient discrepancy in parallel continual learning","venue":null,"work_id":"60523bdb-c388-4fc4-a27a-7b3632d4c826","year":2023},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:41.574282Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:a4a53aa5ead77bb27a1ba5e0e300fe1c9fc986f35b700e103f3d620a0befb673","observation_id":"9b251139-b4cc-4378-9ea7-1bfc4beb2aac","resolution":{"observed_at":"2026-08-07T14:18:55.030671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:54.571662Z","title":"MAPLE: Multi-modal prompt learning","venue":null,"work_id":"cd044ec8-f28f-4df9-9072-f38c17a53a6e","year":2023},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:41.733658Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:50726cf6faf87dfe372893ccc96c30f87acef31837cc2362cd356a9bd265e839","observation_id":"5db16f86-a349-4ba3-83fa-eb82eecf4be6","resolution":{"observed_at":"2026-08-07T14:18:54.732552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:54.214613Z","title":"Overcoming language priors in visual question answering with adversarial regularization","venue":null,"work_id":"4a6a9809-056b-4cc7-85c4-a269ff11fc7b","year":2018},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:41.933587Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:eb87e3a5ccc796499ac9d8f0f128f48415eddf420a5722a8fe95d4389b64751a","observation_id":"43ad371d-77c6-4d4f-a749-2b9d63cc585f","resolution":{"observed_at":"2026-08-07T14:18:54.412802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:53.917917Z","title":"Making the v in VQA matter: Elevating the role of image understanding in visual question answering","venue":null,"work_id":"659b8097-6247-4024-b45c-1d591c069395","year":2017},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:42.083469Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:1f132fe9c4679b1d04a1a193b4bbcd5b484098ca01723e48cfd8de176536f79f","observation_id":"237b70e3-dc83-488d-a892-9b2c00d311a7","resolution":{"observed_at":"2026-08-07T14:18:54.060826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:53.590543Z","title":"Lawrence Zitnick, and Devi Parikh","venue":null,"work_id":"7607f285-9df4-48e3-8791-41f16f3a709f","year":2015},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:42.187884Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:1a30e8e34ba3ac394eb6c7f6f58497700ce1836d4ab6d6d166c98789c626e98e","observation_id":"70209ef8-75c9-493f-a996-d6ae11ef9323","resolution":{"observed_at":"2026-08-07T14:18:53.736161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:53.346068Z","title":"A lifelong learning perspective for mobile robot control","venue":null,"work_id":"e08677de-12bc-4b62-9d51-f70c0877bfd4","year":1995},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:42.329149Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:1a1a7c3872eb5788bc63653703c205dc24b53d2b1d80335be2bf402b316ae6bc","observation_id":"c80d7d0b-7d58-4398-8070-651ddba2b3c0","resolution":{"observed_at":"2026-08-07T14:18:53.444496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:52.997218Z","title":"Pre- venting zero-shot transfer degradation in continual learning of vision-language models","venue":null,"work_id":"a2751d68-504b-4768-b1d8-dfbefc24ff6d","year":2023},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:42.506071Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:dbe8c96b2479de642b5c8c88a6bdbf2445cbd14283fbbe836ea11a03d2d23a31","observation_id":"5c70ba20-7bea-45a9-8d9e-2e75add3a03d","resolution":{"observed_at":"2026-08-07T14:18:53.172915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:52.678854Z","title":"Bakker, Nicu Sebe, and Michael S","venue":null,"work_id":"9281c1c4-21b1-4156-9c9d-bb0f9a6b705b","year":2023},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:42.625308Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:cb2d9e93ac0a63a1b93662c29bfcc01f6179ca451f9dda2befbefdd947ec226e","observation_id":"21d07dd1-800e-4786-85b1-bb83db898b79","resolution":{"observed_at":"2026-08-07T14:18:52.778162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:52.409798Z","title":"Boosting continual learning of vision-language models via mixture-of-experts adapters","venue":null,"work_id":"2c3f2c7e-5141-40fb-bcba-d2f9875fce1f","year":2024},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:42.809398Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:d1a68d526c694431aefc820c72eeacf205a5e3e02eb342c6335a76207aa35049","observation_id":"6cfdf7fe-11d6-4319-99c8-b6162bfe8e5a","resolution":{"observed_at":"2026-08-07T14:18:52.553431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:52.167237Z","title":"Learn to grow: A continual structure learning framework for overcoming catastrophic forgetting","venue":null,"work_id":"f4d14bcc-d796-4981-a802-b58b052ad798","year":2019},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:42.913039Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:469ed0bb627b600662ddae735a2b70fd593c3d16d2d12e9f6ceaef3afc474399","observation_id":"3e396b1e-cf57-454d-9641-ba791695c299","resolution":{"observed_at":"2026-08-07T14:18:52.265906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:51.811739Z","title":"Ex- perience replay for continual learning","venue":null,"work_id":"473dca6f-8d37-4381-be60-faf8dbd10560","year":2019},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:43.051597Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:beee753c3b64711c95a687528627b12e82eea6b635c26dfdf407808079f01f2a","observation_id":"631255ab-0ad6-4160-b3c4-f0f9169afc88","resolution":{"observed_at":"2026-08-07T14:18:51.993430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:51.531117Z","title":"Dark experience for general continual learning: A strong, simple baseline","venue":null,"work_id":"f1ec914e-01ef-496d-ba37-1e68a27d2ee6","year":2020},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:43.197659Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:dbc7a35ac64913e952227499d8deebdf8dbbd6a18f6ac7185cb57eafbf8dcf3c","observation_id":"6f3b90d0-62f3-4fae-8bd0-f18f9d6b6bbc","resolution":{"observed_at":"2026-08-07T14:18:51.689768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:51.288671Z","title":"A continual learning survey: Defying forgetting in classification tasks.IEEE Transactions on Pattern Analysis and Machine Intelligence, pages 3366–3385, 2021","venue":null,"work_id":"f9fd3612-fab1-4815-82fc-e0156d364eb2","year":2021},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:43.327033Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:c3be72436c39bfaf16aa64a7347cba2ed43dcdf3715f5bff73ed4d71c334a69c","observation_id":"803b3c9d-a998-4371-8ec5-bca40dc484e1","resolution":{"observed_at":"2026-08-07T14:18:51.397181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:43.480038Z","title":"Yu, and Irwin King","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:43.480038Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:de6a4deb6498714f22cb999359fa928d4ee0151f7683d35cd74baa350fa12753","observation_id":"c174679f-b047-4d86-921b-77da94b15948","resolution":{"observed_at":"2026-08-07T14:18:43.480038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:51.014623Z","title":"Balanced multimodal learning via on-the-fly gradient modulation","venue":null,"work_id":"6529b408-5c21-4c34-a191-9db28948ae39","year":2022},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:43.549152Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:4561bf99c05feca21ec694cfed7fac0f599d5d3d6b64d370066f996b2dfb0808","observation_id":"743388c0-d14e-45d7-ae35-51a1893b90d8","resolution":{"observed_at":"2026-08-07T14:18:51.120558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:50.704038Z","title":"Pre-trained models: Past, present and future.AI Open, pages 225–250, 2021","venue":null,"work_id":"dea9ba72-05b2-42d7-9ecf-121cc9b31fe5","year":2021},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:43.646275Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:0f7b5918ef7af6eb15fe615e2efe133d4c3ab6dc883c5fd33c3e5d2205e16869","observation_id":"cdb1a1a3-d0bf-42d0-a702-8bc1cae5276f","resolution":{"observed_at":"2026-08-07T14:18:50.865018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:50.374912Z","title":null,"venue":null,"work_id":"7fccd129-0b28-448e-9d84-af417a21b508","year":2020},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:43.718731Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:0d4b1e29e1e57bdbb10a2dd67c507cb674218cea2aba645984c30299254449ff","observation_id":"86c661f7-5eef-4423-b75d-78c4f288c359","resolution":{"observed_at":"2026-08-07T14:18:50.550263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07490","last_updated":"2019-12-03T19:30:19Z","snapshot_observed_at":"2026-08-06T03:44:36.669916Z","submitted_at":"2019-08-20T17:05:18Z","title":"LXMERT: Learning Cross-Modality Encoder Representations from Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07490","snapshot_observed_at":"2026-08-07T14:18:43.801881Z","title":"LXMERT: Learning cross-modality encoder representations from transformers.arXiv preprint arXiv:1908.07490, 2019","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:43.801881Z"},"links":{"cited_paper":"/paper/1908.07490","citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:bfb297e5949e821403a6f819b3b5175004114a45046571a5079d92f9ed266697","observation_id":"e3966b13-3e4a-4d4c-850c-bd9290508bb3","resolution":{"observed_at":"2026-08-07T14:18:43.801881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:50.024417Z","title":"DyTox: Trans- formers for continual learning with dynamic token expansion","venue":null,"work_id":"cbca22c4-c41a-4171-b9b6-fbb390cb2224","year":2022},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:43.925124Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:c6a4d22274f83eaaa8c9ba2e4c6b3977a3cec6ca81eba06184b60862759fce04","observation_id":"955dbc63-ca53-4d0c-aa9a-67732d5d63cb","resolution":{"observed_at":"2026-08-07T14:18:50.197997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:49.775544Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"7c513b30-e800-4931-b53f-50122b15d2ff","year":2021},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:44.029603Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:5b015168785d15f26d7fcfa2ee5dce7b2b939e80cd2404b902d806dafde6b654","observation_id":"4bff90a1-d510-4dca-94ec-7801bc613390","resolution":{"observed_at":"2026-08-07T14:18:49.892421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:49.428562Z","title":"Understanding driving risks via prompt learning","venue":null,"work_id":"1e86f47b-4f3a-4fa1-9575-3059f67ccb2d","year":2024},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:44.129858Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:82dc983cef5d7213972451677397dc4a1adb3d33d927cea5dc3c3fb7d9416e20","observation_id":"62044c85-dfe2-4f54-b81a-d161c3060f30","resolution":{"observed_at":"2026-08-07T14:18:49.565975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:49.170499Z","title":"Attention bottlenecks for multimodal fusion","venue":null,"work_id":"e02740b8-cc70-49e7-958e-35c3581a80b9","year":2021},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:44.250330Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:10fde4d71ebf5b064483e832b8c088ccb44491fa13e7a95dfe107c5ed5384c88","observation_id":"8bd7b5b4-bdea-432a-861b-01db032a8db2","resolution":{"observed_at":"2026-08-07T14:18:49.297569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:48.837079Z","title":"Difnet: Boosting visual information flow for image captioning","venue":null,"work_id":"4cc91cdc-e32a-4f7d-8978-c3285cd6f453","year":2022},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:44.369136Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:df8fc7a8a08b4cf0e106f3d2ffb399a80c3b862aa27ad29498464bda0dbdac67","observation_id":"70997690-a4ce-45f6-9772-630cf5f68273","resolution":{"observed_at":"2026-08-07T14:18:48.980507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:48.559182Z","title":"Aligning visual regions and textual concepts for semantic-grounded image representations","venue":null,"work_id":"99712f71-86ad-4765-b2f3-b0399e28580d","year":2019},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:44.478499Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:b111a395c28c7699cab463a5a1395106cd2bf840ba63a741ba518ebba86c06c5","observation_id":"d494e25d-0efa-4917-8cee-caa28cd4a5f1","resolution":{"observed_at":"2026-08-07T14:18:48.663665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:48.243980Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"d99de7a8-f3ac-4556-a4a7-c47139cc2781","year":2022},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:44.622402Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:886493e08c1630e27537d1f2b7a634751b3597ddced44f17a2de92cf4a1e9141","observation_id":"7bf90daf-328b-4d20-9e9a-b12e51906647","resolution":{"observed_at":"2026-08-07T14:18:48.441359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.00173","last_updated":"2022-07-30T09:59:28Z","snapshot_observed_at":"2026-08-04T07:42:14.183883Z","submitted_at":"2022-07-30T09:59:28Z","title":"A Survey on Masked Autoencoder for Self-supervised Learning in Vision and Beyond","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.00173","snapshot_observed_at":"2026-08-07T14:18:44.745026Z","title":"A survey on masked autoencoder for self-supervised learning in vision and beyond","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:44.745026Z"},"links":{"cited_paper":"/paper/2208.00173","citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:a9c32858b248b8975764dfc7b6d05d78d8e2be40828d340ecfc884eb22bef94d","observation_id":"cb88f53b-56bb-45d3-a44b-db000d993c3a","resolution":{"observed_at":"2026-08-07T14:18:44.745026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:47.988230Z","title":"Can we gain more from orthogonality regularizations in training deep networks? InAdvances in Neural Information Processing Systems (NeurIPS), 2018","venue":null,"work_id":"776a89e7-98af-4108-a72c-3fada4ae2dff","year":2018},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:44.854051Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:bfa7d38a8ec51d88d5cc9f20d171bf90a6f4ae59a7c841b4970bf3f33ca10a08","observation_id":"ccaa9d9f-cdee-4e79-bc59-91990f4f9e7f","resolution":{"observed_at":"2026-08-07T14:18:48.119044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:47.698836Z","title":"NExT-QA: Next phase of question answering to explaining temporal actions","venue":null,"work_id":"cda66eed-fc15-453c-af84-8333a41921d6","year":2021},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:44.946111Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:1dc36a1a144ccfaa1eb0c83880232eb995ba065db6b643f4de7513cac2af0dd6","observation_id":"96122ca3-70b4-4fb7-9c68-0b641f3927a0","resolution":{"observed_at":"2026-08-07T14:18:47.810672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:47.438778Z","title":"A simple weight decay can improve generalization","venue":null,"work_id":"aa255479-b8a0-4e72-b6c0-c509fb0e3bea","year":1991},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:45.088368Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:3f1a01ae1fedbc63b454db92fce1639687e86dae58143b6b138998c344b75146","observation_id":"72d88bc0-f0aa-417a-91b8-037b2f7322c4","resolution":{"observed_at":"2026-08-07T14:18:47.551554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:47.159002Z","title":"Bottom-up and top-down attention for image captioning and visual question answering","venue":null,"work_id":"6e265fb5-db1c-42ad-8017-30ed769d622d","year":2018},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:45.264873Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:568502fcf6b6c1e2aad77c1458e6a6345be93e0f540a08e74e3e66cdd75e2dd7","observation_id":"2e79ac51-df0b-40c6-91ca-cc1e558b8d17","resolution":{"observed_at":"2026-08-07T14:18:47.282811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:46.836421Z","title":"Visualizing data using t-SNE.Journal of Machine Learning Research, pages 2579–2605, 2008","venue":null,"work_id":"3557eb74-1428-4744-996a-7f187cc0ae54","year":2008},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:45.420900Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:cbd8fa8d22da51f99a91357d9431f8dcd6d79aefd85fd92bb2e56d9bcd42f262","observation_id":"0aa209b1-8d7c-4312-9310-a85912551606","resolution":{"observed_at":"2026-08-07T14:18:46.956737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:46.541089Z","title":"Scaling instruction-finetuned language models.Journal of Machine Learning Research, 2024","venue":null,"work_id":"7ed89c57-8cb0-4833-89ed-643f5705290f","year":2024},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:45.539148Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:90bc0cc7f6107fdfcce52ca3f3ed074ba211c39b3c199f8f9972fcbfcab6b3f7","observation_id":"3eb9922d-d7b6-4c2f-9173-1f5e80ce4b86","resolution":{"observed_at":"2026-08-07T14:18:46.672087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:46.297213Z","title":"Plus”, “Mean Pooling","venue":null,"work_id":"35f330b9-4e19-4936-82dc-ef39e74a4077","year":2020},"citing_paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:45.684227Z"},"links":{"citing_paper":"/paper/2505.19455"},"observation_digest":"sha256:d454ebcc127fd8811f19ddb08c24eaf6f834092ac6d70751eb2429ca6eb103cd","observation_id":"f0ed1da2-ed8a-4d9b-a2b2-41744b569d0b","resolution":{"observed_at":"2026-08-07T14:18:46.411761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19455","last_updated":"2025-09-11T17:29:56Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T14:11:42.867055Z","submitted_at":"2025-05-26T03:21:21Z","title":"MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":1,"verified_fuzzy":41},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 1 inbound Pith citation observation for arXiv:2505.19455."}