{"as_of":"2026-08-07T15:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:143a503ca3a4164c591389555da926dd58c0cf5a0730dfbfcfbcce04555a1c52","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:46:32.312024Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.01225/citation-record","integrity":"/paper/2508.01225/integrity","json":"/paper/2508.01225/citation-record.json","paper":"/paper/2508.01225"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.029565Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.029565Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:a9718c4321ea1b7ab986219ceb8b975a9fca00d629402248896d26af447df975","observation_id":"22fa6396-83ee-4773-b9c4-c8c9a4ff5679","resolution":{"observed_at":"2026-08-06T05:46:32.029565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.034293Z","title":"Align your prompts: Test-time prompting with distribution alignment for zero-shot generalization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.034293Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:63c29af949339b468556867bd8c3904a221aad79b1cf8bdeb679b29e80714bda","observation_id":"e5dc9d18-76b7-4775-9984-a3887c0735c2","resolution":{"observed_at":"2026-08-06T05:46:32.034293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.265281Z","title":"Dpa: Dual prototypes alignment for unsupervised adaptation of vision-language models","venue":null,"work_id":"3ae60d12-7f06-47e7-b9d5-0a98ebc883b7","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.038343Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:794386dbecb8318c23bb2bc21c6225fe2a54f061ced879df96b1c89782bf3924","observation_id":"97e9c35c-b097-464a-9ad0-6b202723ecc5","resolution":{"observed_at":"2026-08-06T05:46:33.269007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.253895Z","title":"Food-101--mining discriminative components with random forests","venue":null,"work_id":"be2a4c70-51fd-4a46-be07-8c4ed64aa4a1","year":2014},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.041745Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:213383f4f3cc68f34e27df2f0bfb96574a75d0a13dc333096cb1d5bba44f3728","observation_id":"57822feb-419c-4b63-8adb-f9a40eddd7cb","resolution":{"observed_at":"2026-08-06T05:46:33.257708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05466","last_updated":"2025-01-28T05:29:55Z","snapshot_observed_at":"2026-08-07T11:52:40.451278Z","submitted_at":"2024-09-09T09:48:27Z","title":"Proto-OOD: Enhancing OOD Object Detection with Prototype Feature Similarity","version":2},"cited_work":{"arxiv_id":"2409.05466","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.05466","snapshot_observed_at":"2026-08-06T05:46:32.711417Z","title":"Proto-OOD: Enhancing OOD Object Detection with Prototype Feature Similarity","venue":"cs.CV","work_id":"d8afbb5f-ae5a-4c36-8647-e004da87e309","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.045410Z"},"links":{"cited_paper":"/paper/2409.05466","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:5955fecd1e0b03dfb483611a064cdbc799effc91bab7185519f1f15c219efcb2","observation_id":"4c81c213-17af-4ef3-af96-4d38c1e48717","resolution":{"observed_at":"2026-08-06T05:46:32.715361Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.242005Z","title":"Describing textures in the wild","venue":null,"work_id":"db67ee9a-bd5e-4109-b4b9-4156dc59419e","year":2013},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.049279Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:343fa89a4dacdbacef43222b624ca1ec3428db174d7c18088461f3287f3a489a","observation_id":"bc55afde-b573-4c70-aabb-9eda235e00ab","resolution":{"observed_at":"2026-08-06T05:46:33.246066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.230122Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"febd5de0-79c4-436c-94ca-b2b714377bb4","year":2009},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.052929Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:7e38a0489d4dd0c870e4137ad7e8301cb43a32f2ad8510c7c328c3e0c5e5d3ca","observation_id":"e3641f26-c0d2-4559-9dc9-a2135f6dfac5","resolution":{"observed_at":"2026-08-06T05:46:33.233991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.218615Z","title":"Learning to prompt for open-vocabulary object detection with vision-language model","venue":null,"work_id":"972972bc-bca2-42d8-8e0e-03e7552facb3","year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.056698Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:68c6b4610dfa19c72de7c183328a5a3409c6a679fd4d6a7d1c68b72de99f9763","observation_id":"3df8d724-02b4-47e0-bb81-2339e2e4d24a","resolution":{"observed_at":"2026-08-06T05:46:33.222368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.207562Z","title":"Learning generative visual models from few training examples: An incremental bayesian approach tested on 101 object categories","venue":null,"work_id":"ee4881d5-de7c-4d7f-9534-76a40313ced5","year":2004},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.060300Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:7c3866fe65fb56d3804fc7139d01f8c206b4ee6b23f2e9c01b84a1dc4f9ec6ef","observation_id":"63289751-34e3-44da-958c-6f41a3263845","resolution":{"observed_at":"2026-08-06T05:46:33.211368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.196275Z","title":"Diverse data augmentation with diffusions for effective test-time prompt tuning","venue":null,"work_id":"d4a4d4e8-1149-4626-91e7-86e7bf25eb8d","year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.063609Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:bef4ef1428cdceb6f36acd0df9daf4199ae0c5bcd2ea9cb0339c9addb7e35bf8","observation_id":"c54e37b3-a3fc-4be1-9e31-cac8ced2c9a8","resolution":{"observed_at":"2026-08-06T05:46:33.200204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.185538Z","title":"Khan, and Wangmeng Zuo","venue":null,"work_id":"6ef0df44-f963-4753-bcc8-2fbd6e10a743","year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.067385Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:b70cc36b32b15183d961535719557e239e6da156b4bbc4bdf5013e32dd84f37e","observation_id":"072f70f7-6106-4ee6-b358-8356a4d8ddcd","resolution":{"observed_at":"2026-08-06T05:46:33.189039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.174945Z","title":"Adapter merging with centroid prototype mapping for scalable class-incremental learning","venue":null,"work_id":"b53bfbb5-f9e2-495b-a2cf-da5a913663b9","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.070665Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:3a470d29912cf14a92e1dfe7b07e942bd2be8f8c154810ad414bd21a7912b886","observation_id":"5dc6467c-833c-448e-8426-44c1fed8f72b","resolution":{"observed_at":"2026-08-06T05:46:33.178700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.074090Z","title":"Clip-adapter: Better vision-language models with feature adapters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.074090Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:ef1daa31db9ea2810b4ffc5cbc0606cb3bc9d26bbf1ec00a7cfb57a660bcfef1","observation_id":"dc6a84ea-0f14-4cd1-9aa7-66c5e7923e6c","resolution":{"observed_at":"2026-08-06T05:46:32.074090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.158183Z","title":"Queryable prototype multiple instance learning with vision-language models for incremental whole slide image classification","venue":null,"work_id":"b76acc38-568a-435c-b734-4c6ba4c31e89","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.077569Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:6d698ab32de08ddd66b6ddf1a7582a710281610402c82859f50d71d044744439","observation_id":"1edf48d1-8f87-4872-b305-faa97b20c772","resolution":{"observed_at":"2026-08-06T05:46:33.161730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.147300Z","title":"Open-vocabulary object detection via vision and language knowledge distillation","venue":null,"work_id":"5cb50d01-78c2-4b2a-9d57-dff912aa7626","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.081160Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:d95b529ed4ed66562aedee2ab3ad305b98e7e2c84e00cf75bf4a25362308b6ad","observation_id":"b3c55728-5447-406e-b96a-d0032df28dd4","resolution":{"observed_at":"2026-08-06T05:46:33.151350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.136497Z","title":"Huang, and Shi-Min Hu","venue":null,"work_id":"b0a62aa7-03db-4f63-bb9f-a37370b7c883","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.084962Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:b5bef604cb08a71ce6edbd4b182d09a0a01d5840e42fdbc30e07e437f2d74b6f","observation_id":"770a26b3-1dd6-4980-a3b4-7da607aeafd3","resolution":{"observed_at":"2026-08-06T05:46:33.140148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16441","last_updated":"2025-05-22T09:29:38Z","snapshot_observed_at":"2026-08-07T14:58:44.313460Z","submitted_at":"2025-05-22T09:29:38Z","title":"Ranked Entropy Minimization for Continual Test-Time Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16441","snapshot_observed_at":"2026-08-06T05:46:32.088296Z","title":"Ranked entropy minimization for continual test-time adaptation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.088296Z"},"links":{"cited_paper":"/paper/2505.16441","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:32ca06a381f6d101e6f2035d4b0de278feb457e4409e997de2d38aacb748fda0","observation_id":"274f8624-92a4-4ffa-98d3-2c5454a751f7","resolution":{"observed_at":"2026-08-06T05:46:32.088296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.125437Z","title":"Point-tta: Test-time adaptation for point cloud registration using multitask meta-auxiliary learning","venue":null,"work_id":"d9caeb96-817f-4bf9-8d2e-9289296c7d0a","year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.092163Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:a880d265c5e1293d30c943626720c7a1f9b8a23f0be639e19e86c169006ed77a","observation_id":"7a78677f-4cf0-40f7-aef0-4d7ae40547f1","resolution":{"observed_at":"2026-08-06T05:46:33.129251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.095867Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.095867Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:dacb7e0e8b0594f05d69c9d1715a23014b8e34639bb9aab216aedcd5b01527d4","observation_id":"d205a4f5-a360-4e4e-849e-2ca0cc48dffb","resolution":{"observed_at":"2026-08-06T05:46:32.095867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.107947Z","title":"The many faces of robustness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":"8e53728b-eddb-4565-9370-62630a93b72c","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.099034Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:eaa0a71207cec3cd23c9024e47faa75804f5b4fa7645b633d41f0815fe8a10cd","observation_id":"7c852298-20b0-4719-9da0-a8929e3d6cb9","resolution":{"observed_at":"2026-08-06T05:46:33.111877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.097453Z","title":"The many faces of robustness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":"bde7f049-500f-4aa2-adf6-e3dcec4530a4","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.102913Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:0f8cee3e75a7e4e0302fc561c64b1517135a6b3ea00c0ce84058a26b0c5629bd","observation_id":"42e7a5a5-3cd9-4eaa-a600-d7a15c346c90","resolution":{"observed_at":"2026-08-06T05:46:33.100971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.086448Z","title":"Natural adversarial examples","venue":null,"work_id":"5a82d4db-2fd7-4c4e-b6c5-0a1f1e36ead4","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.106480Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:35904ef122b8f016280de868ae9c0bb1a9bebc81602bce898ac567b5b7734379","observation_id":"5f651cf4-eae6-481a-9059-9dde9d55db7e","resolution":{"observed_at":"2026-08-06T05:46:33.090129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.075601Z","title":"Scaling up vision-language pretraining for image captioning","venue":null,"work_id":"045bef92-9f87-4fac-a77d-f22c93b517e2","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.109828Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:17688451b6c04678c598e6282d6b9f159932093f0f81d4afe0abb5f9ce11a76a","observation_id":"ee90338e-8766-4242-8cd5-09fdd567e526","resolution":{"observed_at":"2026-08-06T05:46:33.079406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20704","last_updated":"2025-06-04T07:00:00Z","snapshot_observed_at":"2026-08-07T13:46:15.375259Z","submitted_at":"2025-05-27T04:30:13Z","title":"Beyond Entropy: Region Confidence Proxy for Wild Test-Time Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20704","snapshot_observed_at":"2026-08-06T05:46:32.113176Z","title":"Beyond entropy: Region confidence proxy for wild test-time adaptation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.113176Z"},"links":{"cited_paper":"/paper/2505.20704","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:87d38910afb0dd958ec7f86b34fc68e9b841e3fcd5aeff0a324835cf86876591","observation_id":"1bd1bb0b-0a77-43ab-8a9d-64ebe19dd355","resolution":{"observed_at":"2026-08-06T05:46:32.113176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.065007Z","title":"Le, Yun-Hsuan Sung, Zhen Li, and Tom Duerig","venue":null,"work_id":"2d633710-5ae1-4693-8b4f-9001e7d41ada","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.116718Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:029d2a913e7a6701183e69ccebfe218a9395c5914dea2a07812bda7134048424","observation_id":"972a4e97-c828-4b55-b5a4-852cdfe9c36d","resolution":{"observed_at":"2026-08-06T05:46:33.068649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.052901Z","title":"Few-shot object detection via feature reweighting","venue":null,"work_id":"432990a4-ca25-4684-ba10-fc166a089a7b","year":2019},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.120050Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:75d6d1c6baf8aa4cb673682c3d7724bdc82dc6442a39f52b590d9db25f78cca5","observation_id":"fc3981a1-b591-4c82-b8ad-d957ab3a60f6","resolution":{"observed_at":"2026-08-06T05:46:33.057080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.040310Z","title":null,"venue":null,"work_id":"8936f681-d0fe-4908-b084-172ecef1ac58","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.123577Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:aa51023802855f45f062cc83985a9036fc8d27389d2d692b87e288605cf7fc3c","observation_id":"f81cc1d5-840e-4e42-9ae7-8dc52c57ad9e","resolution":{"observed_at":"2026-08-06T05:46:33.045144Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.028150Z","title":"Khan, and Fahad Shahbaz Khan","venue":null,"work_id":"34884e7a-8555-417c-a1d2-5c76a7c3d4f5","year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.126802Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:6527538b6e48b230a1f2887eaf5677b5f377e36b25fa4104a9f192849e9efa36","observation_id":"d570e990-6172-4265-8bc1-f5b2d760af1f","resolution":{"observed_at":"2026-08-06T05:46:33.032991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.016539Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"c53fe6e1-93b9-4394-851a-30e58f9179c6","year":2013},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.130108Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:a3abf9955ecde574cad9e1fc2bea82b168e5aa8f33ad5007b3df5113546e549d","observation_id":"1e5636c7-2b2b-47bf-9ca9-45cfbf01fead","resolution":{"observed_at":"2026-08-06T05:46:33.020407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07366","last_updated":"2024-03-12T07:01:57Z","snapshot_observed_at":"2026-08-03T18:17:50.722742Z","submitted_at":"2024-03-12T07:01:57Z","title":"Entropy is not Enough for Test-Time Adaptation: From the Perspective of Disentangled Factors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07366","snapshot_observed_at":"2026-08-06T05:46:32.133314Z","title":"Entropy is not enough for test-time adaptation: From the perspective of disentangled factors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.133314Z"},"links":{"cited_paper":"/paper/2403.07366","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:f416cd65bc1c4faeb9d221400810cdf438eb43e53c09d98df924e13bdf8e544d","observation_id":"db01d278-53a4-4d29-9081-c45288167cf8","resolution":{"observed_at":"2026-08-06T05:46:32.133314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:33.003592Z","title":"Dpu: Dynamic prototype updating for multimodal out-of-distribution detection","venue":null,"work_id":"571d29b7-ceaf-42d2-ad17-be0a36b50c64","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.136743Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:5332cef86a2f6cff75ca06c2e037c51e4ad78be3bbe17d788c68816e2bc80950","observation_id":"a73be666-3a5c-4e11-b876-e58aca289840","resolution":{"observed_at":"2026-08-06T05:46:33.008117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.992044Z","title":"Promptkd: Unsupervised prompt distillation for vision-language models","venue":null,"work_id":"eb029782-6060-4c70-bc70-e9b8f2e466a6","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.140026Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:e59667907a6015c02ec953729cbd24bf07d5267cf3b81ec7d1a235e5b27fd4d8","observation_id":"01da3fdc-46e5-47cd-aa05-6007a774c55b","resolution":{"observed_at":"2026-08-06T05:46:32.995892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.143276Z","title":"A comprehensive survey on test-time adaptation under distribution shifts","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.143276Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:973a4f725c87438b04bc4fa5fe755818fb306d6fe09aa985cc4bfa5f49f0c63f","observation_id":"e87baa48-4fc8-4b49-aaa9-60a79a4c1e0d","resolution":{"observed_at":"2026-08-06T05:46:32.143276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09500","last_updated":"2025-08-13T04:24:56Z","snapshot_observed_at":"2026-08-06T17:51:58.457067Z","submitted_at":"2025-07-13T05:37:33Z","title":"Advancing Reliable Test-Time Adaptation of Vision-Language Models under Visual Variations","version":2},"cited_work":{"arxiv_id":"2507.09500","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.09500","snapshot_observed_at":"2026-08-06T05:46:32.667366Z","title":"Advancing Reliable Test-Time Adaptation of Vision-Language Models under Visual Variations","venue":"cs.CV","work_id":"5f9d4bea-3dcc-4b3b-b9e7-ecff9294455d","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.146449Z"},"links":{"cited_paper":"/paper/2507.09500","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:cb18555d79d730603e980041b89d364bb74823a4221ddcc7aa012173fde5f25e","observation_id":"88584197-5741-413d-aa0a-50e475c004b9","resolution":{"observed_at":"2026-08-06T05:46:32.671342Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22979","last_updated":"2025-06-28T18:36:22Z","snapshot_observed_at":"2026-08-07T10:33:08.295091Z","submitted_at":"2025-06-28T18:36:22Z","title":"Probabilistic Prototype Calibration of Vision-Language Models for Generalized Few-shot Semantic Segmentation","version":1},"cited_work":{"arxiv_id":"2506.22979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.22979","snapshot_observed_at":"2026-08-06T05:46:32.650439Z","title":"Probabilistic Prototype Calibration of Vision-Language Models for Generalized Few-shot Semantic Segmentation","venue":"cs.CV","work_id":"fc5599be-0941-4569-a2c9-380e37345988","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.150239Z"},"links":{"cited_paper":"/paper/2506.22979","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:05b93f3bb0e76b5bfd9fd531d78f818d037a60f5c4ebc5f9255c8f280695879d","observation_id":"91bf670f-bce6-4652-90e3-20f31677b143","resolution":{"observed_at":"2026-08-06T05:46:32.655258Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02653","last_updated":"2024-02-05T00:52:50Z","snapshot_observed_at":"2026-07-06T17:25:14.115360Z","submitted_at":"2024-02-05T00:52:50Z","title":"Learning with Mixture of Prototypes for Out-of-Distribution Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02653","snapshot_observed_at":"2026-08-06T05:46:32.154250Z","title":"Learning with mixture of prototypes for out-of-distribution detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.154250Z"},"links":{"cited_paper":"/paper/2402.02653","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:6044e09cca4243bdfe101d0f2dfb27083f7576e8b79aadfe493cb56dae715cd1","observation_id":"c50a8507-60ab-4467-9c1a-c37e3e0e409d","resolution":{"observed_at":"2026-08-06T05:46:32.154250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-07-06T03:16:28.287173Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-06T05:46:32.158008Z","title":"Fine-grained visual classification of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.158008Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:ba5a14f6bc80b7da98dd73bc8f2be0830440b13c0cb10b8f5042cad61a7f2410","observation_id":"0b2848de-7893-4628-bbe9-fdbfa6f0dd57","resolution":{"observed_at":"2026-08-06T05:46:32.158008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.972553Z","title":"Black-box test-time prompt tuning for vision-language models","venue":null,"work_id":"593771f9-e40e-4765-93e3-b34ddee0bc54","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.161403Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:701a3defa546331c719e498cecd6e8e39cc1cdde69cce59a3c24bc61dc36d7b9","observation_id":"7bfdaf00-342f-443a-a8e6-a11e893615f8","resolution":{"observed_at":"2026-08-06T05:46:32.976421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04873","last_updated":"2024-05-21T06:56:53Z","snapshot_observed_at":"2026-07-06T14:28:44.504142Z","submitted_at":"2022-12-09T14:24:39Z","title":"Multimodal Prototype-Enhanced Network for Few-Shot Action Recognition","version":3},"cited_work":{"arxiv_id":"2212.04873","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.04873","snapshot_observed_at":"2026-08-06T05:46:32.616361Z","title":"Multimodal Prototype-Enhanced Network for Few-Shot Action Recognition","venue":"cs.CV","work_id":"e4394547-d3ac-4555-bdaa-528c2854aba7","year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.164631Z"},"links":{"cited_paper":"/paper/2212.04873","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:8b176bf6bfa66b95821ccf330274740abd47cc847a84dca605192eae37a6af2b","observation_id":"58d65caa-332d-4c28-bca1-0a8e44095b76","resolution":{"observed_at":"2026-08-06T05:46:32.620822Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.959397Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":"5bff29e9-60b8-4bdd-bbd2-5ffd331465b5","year":2008},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.168305Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:90c54ff38967908e8a48e32bd8cd0d25a5964b5d86e250bb1adb43e0d3be4268","observation_id":"de3ba7b2-cbe4-4597-8d9c-c62f858d147a","resolution":{"observed_at":"2026-08-06T05:46:32.963791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.947460Z","title":"Proto-clip: Vision-language prototypical network for few-shot learning","venue":null,"work_id":"86887369-7dbe-46fc-9fce-6e7b3a8958e8","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.171643Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:18c8a4e3eb8308a9631b9c5c483d84b221a273669d6a0ae6f356d371bc30064a","observation_id":"c7e654dd-b5d0-490b-89e7-acde16f98099","resolution":{"observed_at":"2026-08-06T05:46:32.951326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.934167Z","title":null,"venue":null,"work_id":"a2e82316-0c2b-45f3-aa13-3daad7d309e0","year":2012},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.175224Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:a2c49d8e4521c151b8510ef948f7e9af74907bc16098829c20aef4e135ae09f7","observation_id":"56f086f9-ded6-49ea-b766-2b3e75cc63b9","resolution":{"observed_at":"2026-08-06T05:46:32.938577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.922425Z","title":"What does a platypus look like? generating customized prompts for zero-shot image classification","venue":null,"work_id":"2e70bb18-4255-4f38-8306-356a48ed1081","year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.178980Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:0ce6267230603869fd16b2b763297e4bda794f11a3ea60269ba4cba146ea32bc","observation_id":"61175348-1f8d-440e-aa2c-36f87f9c839a","resolution":{"observed_at":"2026-08-06T05:46:32.926291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09394","last_updated":"2025-07-12T06:36:58Z","snapshot_observed_at":"2026-07-06T20:51:23.273195Z","submitted_at":"2025-03-12T13:40:33Z","title":"Bidirectional Prototype-Reward co-Evolution for Test-Time Adaptation of Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09394","snapshot_observed_at":"2026-08-06T05:46:32.182173Z","title":"Bidirectional prototype-reward co-evolution for test-time adaptation of vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.182173Z"},"links":{"cited_paper":"/paper/2503.09394","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:11aee22b34082eed2c93f19306123daf5490ece72c3f9cbf20a75a1d012dad63","observation_id":"0e9e456c-e9fd-4324-94ed-6d51846499e1","resolution":{"observed_at":"2026-08-06T05:46:32.182173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06501","last_updated":"2025-02-22T14:28:05Z","snapshot_observed_at":"2026-07-06T20:33:57.434346Z","submitted_at":"2025-02-10T14:20:01Z","title":"Learning Clustering-based Prototypes for Compositional Zero-shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06501","snapshot_observed_at":"2026-08-06T05:46:32.185679Z","title":"Learning clustering-based prototypes for compositional zero-shot learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.185679Z"},"links":{"cited_paper":"/paper/2502.06501","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:1de241fe2a0f103b7d535b14b7d9084f506f54139d074bda63a45b7bba9af84a","observation_id":"66588149-311d-4d5d-825d-9fa5da80cc49","resolution":{"observed_at":"2026-08-06T05:46:32.185679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.189180Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.189180Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:94617b815b61e9f2d8f8f894e97f58900b95dc8a84f9daff0703712822cc75f6","observation_id":"4785b463-208e-453b-bd24-3f402cea8be6","resolution":{"observed_at":"2026-08-06T05:46:32.189180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.904654Z","title":"icarl: Incremental classifier and representation learning","venue":null,"work_id":"cb7f2efa-d039-42f1-b2b5-ad89c5925dbf","year":2001},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.192756Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:0260455d106121642cf3409906a6726b7327ada4803d27d03972c2cd13c0910c","observation_id":"224e49ab-1099-47d7-9c46-2028e90c7e5c","resolution":{"observed_at":"2026-08-06T05:46:32.908706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.196258Z","title":"Do imagenet classifiers generalize to imagenet? In International Conference on Machine Learning, pages 5389--5400","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.196258Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:4cf6e3fef5b833d88780f016c755a3e50a40b862ea0e86d7044387e4cd2d8662","observation_id":"acc90942-eb06-4705-a745-c3e1932264cb","resolution":{"observed_at":"2026-08-06T05:46:32.196258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.887212Z","title":"One-shot learning for semantic segmentation","venue":null,"work_id":"8e59cebf-c310-47bf-9799-66356c05e1ad","year":2017},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.199548Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:c6c87b3d86bbf91d5a1c7f6c5b5f66c5980199952c5aedf177c7ee3169b0641a","observation_id":"72b00809-23ae-426f-86c5-6cb5d0cc834c","resolution":{"observed_at":"2026-08-06T05:46:32.891260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11195","last_updated":"2025-08-27T08:19:03Z","snapshot_observed_at":"2026-07-06T21:09:45.687370Z","submitted_at":"2025-04-15T13:49:31Z","title":"R-TPT: Improving Adversarial Robustness of Vision-Language Models through Test-Time Prompt Tuning","version":2},"cited_work":{"arxiv_id":"2504.11195","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.11195","snapshot_observed_at":"2026-08-06T05:46:32.583290Z","title":"R-TPT: Improving Adversarial Robustness of Vision-Language Models through Test-Time Prompt Tuning","venue":"cs.LG","work_id":"efc5b1e8-5ef4-4c44-9cd3-6f289c2d0438","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.202937Z"},"links":{"cited_paper":"/paper/2504.11195","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:bf1bf60377b966addb4b51a1bb4d9524973253f69ccedf44adb7c1f503edb805","observation_id":"f77af7e5-c6d6-4491-9681-3970f6e80fd8","resolution":{"observed_at":"2026-08-06T05:46:32.587279Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07511","last_updated":"2022-09-15T17:55:11Z","snapshot_observed_at":"2026-07-06T13:52:47.631776Z","submitted_at":"2022-09-15T17:55:11Z","title":"Test-Time Prompt Tuning for Zero-Shot Generalization in Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07511","snapshot_observed_at":"2026-08-06T05:46:32.206746Z","title":"Test-time prompt tuning for zero-shot generalization in vision-language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.206746Z"},"links":{"cited_paper":"/paper/2209.07511","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:8700e2c31366755ff2ac72aecca31c230002012867bfe5157f7894569a19de55","observation_id":"c337bbc0-ab82-472c-bbb6-150a4f7e10cc","resolution":{"observed_at":"2026-08-06T05:46:32.206746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.210504Z","title":"Prototypical networks for few-shot learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.210504Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:73db9505795b496dd71681ddb5d01c8ddadedc6c0920dd983e3e2342b4c8af61","observation_id":"02b8bee4-8950-40a3-8858-7daefeed4b01","resolution":{"observed_at":"2026-08-06T05:46:32.210504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-06T05:46:32.213839Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.213839Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:8bb7d064c3d62ef1432eb253fd3b8814315ee2db995e7a8920f412f43382d9cd","observation_id":"acff71a3-a5cc-484b-ab44-8cb8b71c8291","resolution":{"observed_at":"2026-08-06T05:46:32.213839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12952","last_updated":"2024-12-10T22:53:16Z","snapshot_observed_at":"2026-07-06T17:47:13.814205Z","submitted_at":"2024-03-19T17:54:34Z","title":"Just Shift It: Test-Time Prototype Shifting for Zero-Shot Generalization with Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12952","snapshot_observed_at":"2026-08-06T05:46:32.217329Z","title":"Just shift it: Test-time prototype shifting for zero-shot generalization with vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.217329Z"},"links":{"cited_paper":"/paper/2403.12952","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:a777f9bb7c0c2a582376cc02e091a11fdbb3b10bb8008ad91d746379b78b9ead","observation_id":"f3664812-3d43-40f2-9c1e-56d4c43e1564","resolution":{"observed_at":"2026-08-06T05:46:32.217329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.870239Z","title":"Point-cache: Test-time dynamic and hierarchical cache for robust and generalizable point cloud analysis","venue":null,"work_id":"32ffb13d-5977-4819-86b2-658bc3802ac4","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.220924Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:aea00920b920d1d9e137c980d73c5845aa60a27bdc2e539aea3e55476a5048e0","observation_id":"3a5340b9-baa0-4289-b4f5-f2553fc77b52","resolution":{"observed_at":"2026-08-06T05:46:32.873885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-06T05:46:32.224600Z","title":"Representation learning with contrastive predictive coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.224600Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:fc32168fa825b275fb61bb4afa78a8757518d7f607f058b8a55ccd46d378662e","observation_id":"383491c4-63a9-45e9-a613-ac783eb42e71","resolution":{"observed_at":"2026-08-06T05:46:32.224600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.228454Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.228454Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:8440b9c34aca9f683d5d59a19e62e6ff890e7e6637ad8e32345a63c97fb80d59","observation_id":"7fdaf66f-156e-4354-ba60-1975456d3cda","resolution":{"observed_at":"2026-08-06T05:46:32.228454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10726","last_updated":"2021-03-18T17:58:01Z","snapshot_observed_at":"2026-07-06T09:30:32.320227Z","submitted_at":"2020-06-18T17:55:28Z","title":"Tent: Fully Test-time Adaptation by Entropy Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10726","snapshot_observed_at":"2026-08-06T05:46:32.231846Z","title":"Olshausen, and Trevor Darrell","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.231846Z"},"links":{"cited_paper":"/paper/2006.10726","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:3e56f5b6f41002398a7f448623abf2c91020a926b3f1e05d22e26b053f03afe1","observation_id":"7344bde5-5f6b-42a4-913d-643b61da47ea","resolution":{"observed_at":"2026-08-06T05:46:32.231846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.853096Z","title":"Ctpt: Continual test-time prompt tuning for vision-language models","venue":null,"work_id":"7b68ae45-19aa-4bd5-a80b-54228389c6d5","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.235775Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:b603f46654156f27c687e4785e05f9bfae44cd09831dc3f5d73a49d13b11766d","observation_id":"420c4bcf-f715-4271-8d13-80c026219202","resolution":{"observed_at":"2026-08-06T05:46:32.856721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.842670Z","title":"Learning robust global representations by penalizing local predictive power","venue":null,"work_id":"c6d3db88-e9a4-45a1-9bee-7e5baeea3904","year":2019},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.238912Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:8205cd8af2b135f5d0e36e6e86bd342adf452fa89878f14a45788faef9eb387d","observation_id":"a2e2df17-b518-44b6-bbca-9d074f72435b","resolution":{"observed_at":"2026-08-06T05:46:32.846364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.831102Z","title":"Learning robust global representations by penalizing local predictive power","venue":null,"work_id":"e989cf63-1a2e-48b9-b1c5-7258b487cdfb","year":2019},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.241931Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:f6054ae8e45db96f7a19cbad81454382975a2c7fd6f3d0af71c7eb6ab0d22070","observation_id":"3d0551a4-b3af-4f88-bade-5f0982d0cc01","resolution":{"observed_at":"2026-08-06T05:46:32.834957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.819605Z","title":"Deep visual domain adaptation: A survey","venue":null,"work_id":"dbf4e79b-cbb5-453e-8817-d0394ad73fde","year":2018},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.246085Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:2d8085c722d320583be5958b90e444c95c05eed33041991cb45740f3b2c441ba","observation_id":"deabfa66-e0d5-4191-8073-daa2994e692f","resolution":{"observed_at":"2026-08-06T05:46:32.823289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.809348Z","title":"Sun database: Large-scale scene recognition from abbey to zoo","venue":null,"work_id":"faef85e6-7bac-4b58-a284-a768a62f8979","year":2010},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.249312Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:1b6017a291d45761c5296432a3a9fef0a3cb495f1b77f43b898e7e8c50941dc9","observation_id":"0e0582cc-44ca-4bb7-9c89-25ea18ee59fe","resolution":{"observed_at":"2026-08-06T05:46:32.813065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.799224Z","title":"Tran, Yi Xu, Sampath Chanda, Liqun Chen, Belinda Zeng, Trishul M","venue":null,"work_id":"4ca3a076-7247-46ab-81e3-4c11a2aa86d6","year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.252615Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:6dd16144b749071d892ebc4d293f34fe6ec94c46feb9728dd1b16f36ea837271","observation_id":"88c75fb7-aa2c-44b4-a8ad-acfb19c41064","resolution":{"observed_at":"2026-08-06T05:46:32.802710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14119","last_updated":"2024-03-31T13:36:54Z","snapshot_observed_at":"2026-08-06T08:53:00.100346Z","submitted_at":"2024-03-21T04:08:29Z","title":"C-TPT: Calibrated Test-Time Prompt Tuning for Vision-Language Models via Text Feature Dispersion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14119","snapshot_observed_at":"2026-08-06T05:46:32.255963Z","title":"Hasegawa-Johnson, Yingzhen Li, and Chang Dong Yoo","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.255963Z"},"links":{"cited_paper":"/paper/2403.14119","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:3b4cf63d07a1c49b2d6816e492c81cdb67e477a0164c986135ed2e1bec270162","observation_id":"2e942e99-aea2-4464-acd8-0b8b17909cda","resolution":{"observed_at":"2026-08-06T05:46:32.255963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.789038Z","title":"Task residual for tuning vision-language models","venue":null,"work_id":"2b827b6d-3bc4-444f-b74b-7a27f368651c","year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.259371Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:bdd3ce1de778eb71023d1e15a0c3af651ff443bc0a53f2231c596650512a44ab","observation_id":"e73fe529-c715-4313-8dbe-0bfc05aaf2b6","resolution":{"observed_at":"2026-08-06T05:46:32.792595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18334","last_updated":"2025-03-31T10:28:04Z","snapshot_observed_at":"2026-07-06T20:57:34.762004Z","submitted_at":"2025-03-24T04:32:35Z","title":"Mitigating Cache Noise in Test-Time Adaptation for Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18334","snapshot_observed_at":"2026-08-06T05:46:32.263088Z","title":"Mitigating cache noise in test-time adaptation for large vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.263088Z"},"links":{"cited_paper":"/paper/2503.18334","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:8952c61e9b567a3e005825df334c216fd2e6a94741ee7738676e3400d0acf7c6","observation_id":"285c82f3-6c22-40a1-b36c-d48b5968d4f4","resolution":{"observed_at":"2026-08-06T05:46:32.263088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12790","last_updated":"2024-10-16T17:59:49Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-16T17:59:49Z","title":"Dual Prototype Evolving for Test-Time Generalization of Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12790","snapshot_observed_at":"2026-08-06T05:46:32.266544Z","title":"Sycara, and Yaqi Xie","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.266544Z"},"links":{"cited_paper":"/paper/2410.12790","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:e9ed55b11ef436f0bc06ead8c3d3f1c8b5aecd0fab2fc87a2f2335475b3577e1","observation_id":"9d92611c-1bf8-4107-b1bb-98df5eea49e2","resolution":{"observed_at":"2026-08-06T05:46:32.266544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.778203Z","title":"Sycara, and Yaqi Xie","venue":null,"work_id":"d60b663b-8bb4-488e-aaf1-ebf8d3b8a61b","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.270126Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:cdfd34531f3df2013f23eb61806769c7988426e1ce959b899209ffed23e54d4f","observation_id":"249b91bb-5a81-4cbb-9414-87639e981cda","resolution":{"observed_at":"2026-08-06T05:46:32.781843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20346","last_updated":"2024-10-27T06:03:15Z","snapshot_observed_at":"2026-08-04T22:41:24.563106Z","submitted_at":"2024-10-27T06:03:15Z","title":"Historical Test-time Prompt Tuning for Vision Foundation Models","version":1},"cited_work":{"arxiv_id":"2410.20346","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.20346","snapshot_observed_at":"2026-08-06T05:46:32.493258Z","title":"Historical Test-time Prompt Tuning for Vision Foundation Models","venue":"cs.CV","work_id":"3718011a-010c-497b-b618-bbb3db415dcc","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.273370Z"},"links":{"cited_paper":"/paper/2410.20346","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:e516f88bcdef69cb12eca7cd7ce721d2d2fe1d2f96ef3c0698664940325174c5","observation_id":"e4ecd247-fc3b-4448-b74c-de491c795126","resolution":{"observed_at":"2026-08-06T05:46:32.497166Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.767421Z","title":"Memo: Test time robustness via adaptation and augmentation","venue":null,"work_id":"8dd86efd-007d-43dc-bc45-54483d515133","year":2022},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.276720Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:4b25bacab5dbdce47ac3871d7b82580dab0881a83d24b43c9c21057068854186","observation_id":"051cb293-f5c9-4113-996b-adb1f26203b6","resolution":{"observed_at":"2026-08-06T05:46:32.771202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.03930","last_updated":"2021-11-15T04:58:28Z","snapshot_observed_at":"2026-07-31T03:05:21.352948Z","submitted_at":"2021-11-06T18:09:22Z","title":"Tip-Adapter: Training-free CLIP-Adapter for Better Vision-Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.03930","snapshot_observed_at":"2026-08-06T05:46:32.280080Z","title":"Tip-adapter: Training-free clip-adapter for better vision-language modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.280080Z"},"links":{"cited_paper":"/paper/2111.03930","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:d15746edabb8bd3ba2536b023a140fb0e02b79037db7999bcfc1ade116b38875","observation_id":"efb6f400-10fc-494c-b126-5f0cd2893000","resolution":{"observed_at":"2026-08-06T05:46:32.280080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15430","last_updated":"2024-10-24T06:41:48Z","snapshot_observed_at":"2026-07-06T19:36:41.445591Z","submitted_at":"2024-10-20T15:58:43Z","title":"BoostAdapter: Improving Vision-Language Test-Time Adaptation via Regional Bootstrapping","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15430","snapshot_observed_at":"2026-08-06T05:46:32.283611Z","title":"Boostadapter: Improving vision-language test-time adaptation via regional bootstrapping","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.283611Z"},"links":{"cited_paper":"/paper/2410.15430","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:5f27f5075934f6bc6a6f826d8263fbd5be57b15a391ab7851bbd236eff1cde3d","observation_id":"7cd8a72c-bf13-48f5-8d48-eeafe56e47c6","resolution":{"observed_at":"2026-08-06T05:46:32.283611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.757153Z","title":"Adanpc: Exploring non-parametric classifier for test-time adaptation","venue":null,"work_id":"a3b54a3c-ed09-4b6e-8346-5766f46c9297","year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.287183Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:a194593330154894d264e2af32dd4429f838ea053a270cfa291d441b458a7a19","observation_id":"776f35a1-d2e5-4067-8fd9-b138478a1493","resolution":{"observed_at":"2026-08-06T05:46:32.760741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.746088Z","title":"Unsupervised prototype adapter for vision-language models","venue":null,"work_id":"8cd81d89-e13b-419b-a43d-423c341d3ad3","year":2023},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.290610Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:e7f5e8d244b37af66a4c0aaf56b64c9ab09dcae939803beb595f097f4ef3f223","observation_id":"f369c21d-ebff-4299-bbc4-095754b7000b","resolution":{"observed_at":"2026-08-06T05:46:32.749855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08672","last_updated":"2024-07-11T17:04:19Z","snapshot_observed_at":"2026-07-06T18:44:57.578408Z","submitted_at":"2024-07-11T17:04:19Z","title":"NODE-Adapter: Neural Ordinary Differential Equations for Better Vision-Language Reasoning","version":1},"cited_work":{"arxiv_id":"2407.08672","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.08672","snapshot_observed_at":"2026-08-06T05:46:32.458413Z","title":"NODE-Adapter: Neural Ordinary Differential Equations for Better Vision-Language Reasoning","venue":"cs.CV","work_id":"06b31855-8ee2-49a9-bdb7-e52f41991db7","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.293793Z"},"links":{"cited_paper":"/paper/2407.08672","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:79197a714efeabdd4e073e81054fd3168f7763a7720be7ed47f159c294f89908","observation_id":"94302da5-d0f0-4006-af71-219a272a9bf8","resolution":{"observed_at":"2026-08-06T05:46:32.464127Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07457","last_updated":"2024-01-15T04:04:47Z","snapshot_observed_at":"2026-07-06T17:15:27.375387Z","submitted_at":"2024-01-15T04:04:47Z","title":"Concept-Guided Prompt Learning for Generalization in Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2401.07457","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.07457","snapshot_observed_at":"2026-08-06T05:46:32.443883Z","title":"Concept-Guided Prompt Learning for Generalization in Vision-Language Models","venue":"cs.CV","work_id":"0290c4a8-7e97-4561-bb79-bffef2ca72fe","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.297597Z"},"links":{"cited_paper":"/paper/2401.07457","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:d6198fd424d128d540082926a7b87fcb54cdee42e8153d877a8d5afe69a5a9c3","observation_id":"8a19fa93-33ae-410f-a338-95dc0eda8537","resolution":{"observed_at":"2026-08-06T05:46:32.447942Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.735281Z","title":"Dual memory networks: A versatile adaptation approach for vision-language models","venue":null,"work_id":"f3ba9c8b-35bb-495b-ac9f-0b134b3e2488","year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.301222Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:971770e12cc84a7da65f8cfbb1183fe8ff2015b3cb8698b6d87a2e08519596d0","observation_id":"82874f72-6417-4d81-905d-0d47a6077739","resolution":{"observed_at":"2026-08-06T05:46:32.738951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.723952Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":"11943f39-2be7-4ba3-94a6-b7bd8b0cdea8","year":2021},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.304470Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:3305f2e16c46950da0e7376118ecf0f8c634be3470ab96f02276e9ddc6b75551","observation_id":"16c9008d-5f1a-42dc-af68-f0f4afeee43b","resolution":{"observed_at":"2026-08-06T05:46:32.727784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.03657","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:46:32.424166Z","title":"Dynamic multimodal prototype learning in vision-language models","venue":null,"work_id":"0fecdced-41e8-48ec-9438-5c581515e2e7","year":2025},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.307689Z"},"links":{"citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:6887822d62391addc78747ecfd6aec7eb404c6b80c58e34737a0b0eda2ba3788","observation_id":"c94552b9-ea8d-44ab-944a-f929cb16010e","resolution":{"observed_at":"2026-08-06T05:46:32.432652Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05775","last_updated":"2024-08-11T13:55:58Z","snapshot_observed_at":"2026-07-06T18:59:21.352885Z","submitted_at":"2024-08-11T13:55:58Z","title":"Efficient Test-Time Prompt Tuning for Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05775","snapshot_observed_at":"2026-08-06T05:46:32.312024Z","title":"Efficient test-time prompt tuning for vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:32.312024Z"},"links":{"cited_paper":"/paper/2408.05775","citing_paper":"/paper/2508.01225"},"observation_digest":"sha256:f0fce94ce09898eda4af65cf8e88bb0b768ee6f39fc66cfe17167dd24a3a3332","observation_id":"4aaabf6c-4248-4f81-8be1-6f8ea632a24b","resolution":{"observed_at":"2026-08-06T05:46:32.312024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.01225","last_updated":"2025-08-21T20:13:40Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:52:09.246775Z","submitted_at":"2025-08-02T06:43:43Z","title":"Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":9,"verified_fuzzy":43},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 0 inbound Pith citation observations for arXiv:2508.01225."}