{"as_of":"2026-08-08T17:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:db29877891ddd390c98fd0fa2054cafd750d30adbdf87278de164483ae01ecec","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:05:17.765360Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:21:19.132444Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T23:17:14.256179Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06019","snapshot_observed_at":"2026-08-07T15:21:19.132444Z","title":"arXiv preprint arXiv:2502.06019 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15425","last_updated":"2025-05-23T14:16:48Z","snapshot_observed_at":"2026-08-08T11:26:59.016994Z","submitted_at":"2025-05-21T12:08:31Z","title":"On the Robustness of Medical Vision-Language Models: Are they Truly Generalizable?","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:21:19.132444Z"},"links":{"cited_paper":"/paper/2502.06019","citing_paper":"/paper/2505.15425"},"observation_digest":"sha256:94e2941a5976f977b51368c7aa4b2687a0cc476d10756658fcbc3fa214cddf30","observation_id":"bd4549b0-3e2a-421f-bf14-7c5a85841c67","resolution":{"observed_at":"2026-08-07T15:21:19.132444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2502.06019","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06019","snapshot_observed_at":"2026-08-05T23:17:14.256179Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","venue":"cs.CV","work_id":"023ab295-4134-434e-a4d2-1a38138e0187","year":2025},"citing_paper":{"arxiv_id":"2508.05547","last_updated":"2025-08-07T16:27:37Z","snapshot_observed_at":"2026-08-06T15:48:30.505708Z","submitted_at":"2025-08-07T16:27:37Z","title":"Adapting Vision-Language Models Without Labels: A Comprehensive Survey","version":1},"reference_index":167,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:07.021778Z"},"links":{"cited_paper":"/paper/2502.06019","citing_paper":"/paper/2508.05547"},"observation_digest":"sha256:bd3e291f4ff06669ee93a437c78ffb68356f1b0856c80bea393cbed01b902d4a","observation_id":"9ea186bd-6a2d-4f2e-9755-61afd259452c","resolution":{"observed_at":"2026-08-05T23:17:14.261226Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06019","snapshot_observed_at":"2026-08-04T19:13:53.548210Z","title":"Noise is an efficient learner for zero-shot vision- language models.arXiv preprint arXiv:2502.06019, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09397","last_updated":"2025-09-11T12:26:57Z","snapshot_observed_at":"2026-08-06T23:32:44.797789Z","submitted_at":"2025-09-11T12:26:57Z","title":"Decoupling Clinical and Class-Agnostic Features for Reliable Few-Shot Adaptation under Shift","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T19:13:53.548210Z"},"links":{"cited_paper":"/paper/2502.06019","citing_paper":"/paper/2509.09397"},"observation_digest":"sha256:4aad3724ee3a0d59fc3961edaf8244077e74d002f156bb42e7bce4083a7184aa","observation_id":"75b0ab1b-a219-4e23-b106-cf629ad64b23","resolution":{"observed_at":"2026-08-04T19:13:53.548210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.06019/citation-record","integrity":"/paper/2502.06019/integrity","json":"/paper/2502.06019/citation-record.json","paper":"/paper/2502.06019"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.252953Z","title":"Badclip: Trigger-aware prompt learning for backdoor attacks on clip","venue":null,"work_id":"81ee8fe5-f9bd-4c5d-83fa-5205690b15bb","year":2024},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.606028Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:3b3cfddd4df691d7fd6a80a8a993e55e4e6f275e751af54b0bbb492a37f0ef91","observation_id":"06add40f-66f4-42d6-9916-000b795e8480","resolution":{"observed_at":"2026-08-08T17:05:18.256617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.241959Z","title":"Rep- resentation learning: A review and new perspectives","venue":null,"work_id":"bd6b586a-cb6e-4f81-a80d-1008ec28d0e0","year":2013},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.610895Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:db82683060c8914694909423b9f6282b3bbefe46fd530821a6b74f603552e70d","observation_id":"f07f2dd5-021a-4a56-8102-604449ed287f","resolution":{"observed_at":"2026-08-08T17:05:18.245615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.231348Z","title":"Food-101–mining discriminative components with random forests","venue":null,"work_id":"24298ee6-7f5a-44f5-bcca-b98c41a6d45d","year":2014},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.615245Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:cd28cf54e8a3c144b9c80cef25b316fc21e62ef017d53645d2cf5165daa647c3","observation_id":"58f45380-b6fe-4947-b7a0-2c9731914bf6","resolution":{"observed_at":"2026-08-08T17:05:18.235143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.220600Z","title":"Describing textures in the wild","venue":null,"work_id":"8ddd89c5-a5cb-4592-ad3a-9d4cb512065b","year":2014},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.620266Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:a6b3b561e61a919d484b54a0e5afe30ccb887c2b4fdee3f41e0c857107fe7003","observation_id":"f92dc26e-13e5-4479-86f4-9e9c2ea667c6","resolution":{"observed_at":"2026-08-08T17:05:18.224533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.209725Z","title":"Learning gener- ative visual models from few training examples: An incre- mental bayesian approach tested on 101 object categories","venue":null,"work_id":"a1215d37-4e07-4598-9b11-9ff55f185ab9","year":2004},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.624847Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:06ce8a25b88b71c56be4b1adb5eb691633611aa732878fe10fcea4874d37f045","observation_id":"9a262bfe-d48a-4ce7-9ce2-b3287af5125b","resolution":{"observed_at":"2026-08-08T17:05:18.213625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.629208Z","title":"Generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.629208Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:fb1edd94592bc97cd3d78a62c5efe62338a5734756873ee8485deefc2d822af3","observation_id":"d1cbf18a-2011-493b-af89-b70492c2a15b","resolution":{"observed_at":"2026-08-08T17:05:17.629208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.192049Z","title":"Goodfellow, Jonathon Shlens, and Christian Szegedy","venue":null,"work_id":"c82dee19-77c2-41e4-9d3b-d488f86ea80d","year":2015},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.633769Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:8d1a6802fe2485d81535f9eb63efdc3593cee9916eb51f7aa47607d4ee081ca4","observation_id":"6506260d-375d-49ec-a1fc-becf15612e03","resolution":{"observed_at":"2026-08-08T17:05:18.195603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.181361Z","title":"Calip: Zero-shot en- hancement of clip with parameter-free attention","venue":null,"work_id":"4063482d-4772-4554-b6c1-b3a87a039b85","year":2023},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.637899Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:914afa5bdd30ab52c89810606a26fd21c09eefc0837a4c103b30d6cc5ec0a3c0","observation_id":"5f774dd8-677d-41db-97df-a6ab7963265c","resolution":{"observed_at":"2026-08-08T17:05:18.185277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.171202Z","title":"Baple: Back- door attacks on medical foundational models using prompt learning","venue":null,"work_id":"d1c275e8-e528-49ce-b710-7afa9b522f60","year":null},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.642155Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:d5250959e14a8dd544a80525f2117825b2a4983c8337056091bfbdd15c8c1f3a","observation_id":"3dd6c251-ac40-4255-9fc8-e3e227f84e77","resolution":{"observed_at":"2026-08-08T17:05:18.174414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.160988Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":"5c667878-a496-4e79-a6d7-282cc9793b21","year":2019},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.646682Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:9b48852909c5cc61227dd923f73d82e2df69a835fc836d8cd869df9c82555eff","observation_id":"50f59c35-4782-4e30-a9a3-775c195b84e6","resolution":{"observed_at":"2026-08-08T17:05:18.164120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.650651Z","title":"The many faces of robust- ness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.650651Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:5047339130650a39aa4f090503c82b2d3ab0028d1e9331886df6ecda43886ea2","observation_id":"91729fae-8f58-4761-a827-5fe7eddb93b1","resolution":{"observed_at":"2026-08-08T17:05:17.650651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.143869Z","title":"Natural adversarial examples","venue":null,"work_id":"615d43a9-bd00-468e-b12a-4a5fe16f8152","year":2021},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.654489Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:48d7ed613818e687530db2f2867cced55a9190afa17f3790f68a00f871326c3b","observation_id":"e1c7c4d6-3b59-4325-8711-803fada7123c","resolution":{"observed_at":"2026-08-08T17:05:18.147552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.658597Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.658597Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:72760814c0892ca8b3c18573a5e731bd0af25172106ee6352ad1b9fd2c7122bb","observation_id":"17ab93fe-1d0a-466f-a894-6cf4adad2ace","resolution":{"observed_at":"2026-08-08T17:05:17.658597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.126625Z","title":"Test-time low rank adaptation via confi- dence maximization for zero-shot generalization of vision- language models, 2024","venue":null,"work_id":"b3b8f423-bc7f-4c26-8e36-97de63bed767","year":2024},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.662452Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:6cfad6773869f784093105073543caeda8ff90f01cac2b6727d1b46721713ac3","observation_id":"c50ac094-ffd3-4cf7-b319-653bef6dbb26","resolution":{"observed_at":"2026-08-08T17:05:18.130266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.666164Z","title":"Scaling up visual and vision-language representa- tion learning with noisy text supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.666164Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:28c3b6761d177a83c7714bfa5d4d1fd50d46c0626dc11ed6f8d823f6b5884335","observation_id":"c88849e1-8c76-454e-8287-1c50d3b8fdd9","resolution":{"observed_at":"2026-08-08T17:05:17.666164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-08T17:05:17.670166Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.670166Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:246bafa6eb21d285987e5ec03a8407e12f1a9d979c498ad68c99997e69fdd263","observation_id":"2e9c4ffd-78b3-498a-8036-6bc085ce7bcf","resolution":{"observed_at":"2026-08-08T17:05:17.670166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.106661Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"3848e449-2b33-4a61-abae-b1b38b304920","year":2013},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.673471Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:287e3a5954d1b81064ace6180864e37eda7afc36c4cab9725891a7f9d8450b68","observation_id":"264673d6-341d-45d5-9aff-9ff3e742f47e","resolution":{"observed_at":"2026-08-08T17:05:18.110815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.094622Z","title":"Revisiting batch normalization for practical do- main adaptation, 2016","venue":null,"work_id":"3ca0ba89-e392-48bf-a4b1-685179093b7c","year":2016},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.676459Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:0278875e84f5e565d5bf12ffe8a7c3f1b0c8dad974973ed83916c17bb504ad1d","observation_id":"179c0051-3388-42ca-9553-27b220a32694","resolution":{"observed_at":"2026-08-08T17:05:18.098597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-07-06T03:16:28.287173Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-08T17:05:17.679456Z","title":"Fine-grained visual classi- fication of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.679456Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:7db170a4d9b7ac18150f26e73b7ec988d51a70d63e544c1cad48a46e0783ba2c","observation_id":"da1e8594-af99-4280-a083-9310f247a11b","resolution":{"observed_at":"2026-08-08T17:05:17.679456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13588","last_updated":"2024-07-18T15:27:56Z","snapshot_observed_at":"2026-07-06T18:48:33.555151Z","submitted_at":"2024-07-18T15:27:56Z","title":"Robust Calibration of Large Vision-Language Adapters","version":1},"cited_work":{"arxiv_id":"2407.13588","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13588","snapshot_observed_at":"2026-08-08T17:05:17.871200Z","title":"Robust Calibration of Large Vision-Language Adapters","venue":"cs.CV","work_id":"038570e6-4e2e-4748-9245-70e5a8858815","year":2024},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.682725Z"},"links":{"cited_paper":"/paper/2407.13588","citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:4abdba88687b97b93b5ca232733aeab174d655cfeb11013bdae43067cb5deffd","observation_id":"7222ee9a-f2e7-469f-a478-442fccc78cf1","resolution":{"observed_at":"2026-08-08T17:05:17.877440Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.081945Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":"73f1e72c-92dd-4ef6-982c-d06c237a2d25","year":2008},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.686244Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:e31d2e7c9fbaa76924af40b0c5496dd9052da132df3b08e2db6598df512979e1","observation_id":"960b5afc-9bd8-4dc9-8541-81638a56c30b","resolution":{"observed_at":"2026-08-08T17:05:18.085955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.069819Z","title":"Cats and dogs","venue":null,"work_id":"93aefdbd-ab36-444a-9b25-cb6db45b61e9","year":2012},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.689170Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:fffa80d93e1b23938aba427ff4135a21bba2cc58d5ede99d26dba13f4442fa80","observation_id":"a94864d8-69c5-4e42-8a97-ed0f3a4b60ee","resolution":{"observed_at":"2026-08-08T17:05:18.073805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06434","last_updated":"2016-01-07T23:09:39Z","snapshot_observed_at":"2026-08-04T04:34:27.861448Z","submitted_at":"2015-11-19T22:50:32Z","title":"Unsupervised Representation Learning with Deep Convolutional Generative Adversarial Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06434","snapshot_observed_at":"2026-08-08T17:05:17.692177Z","title":"Unsupervised representation learning with deep convolutional generative adversarial networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.692177Z"},"links":{"cited_paper":"/paper/1511.06434","citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:1045a68f2f84ccda14fb5c3dc2dcb280eb500b52c2be3898ac9f13c1d537b676","observation_id":"ed2bacd1-f49f-41e8-b3cd-4632b765dceb","resolution":{"observed_at":"2026-08-08T17:05:17.692177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.057523Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"aaf8cb7c-dd38-4204-a0cf-11a5569a0c87","year":2021},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.696402Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:5d8b9b67bbdf92887b7678e7bb607505198673bce4d891270255c76daa7db266","observation_id":"1fda3c33-d068-41c2-a62a-09ec13c87dcc","resolution":{"observed_at":"2026-08-08T17:05:18.061793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.046024Z","title":"Do imagenet classifiers generalize to im- agenet? In International conference on machine learning , pages 5389–5400","venue":null,"work_id":"8f900d19-31aa-4f8a-b9b8-fc7eb1d70357","year":2019},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.700417Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:e02ecafb86a0e41a7f13065364847af3964327b48b2e4b931be68d23b14fefb2","observation_id":"fb7dc0af-c750-453c-a975-579d05bcefc0","resolution":{"observed_at":"2026-08-08T17:05:18.050088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.034817Z","title":"Stochastic backpropagation and approximate inference in deep generative models","venue":null,"work_id":"aed84a5c-1218-4ccc-87a7-c8d39f71c658","year":2014},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.704229Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:37ef5dbd920778c75e42c8c98725fe2e592f6b3a8463215d9a4662aa70b05718","observation_id":"fe9ace95-0236-4850-8a85-cd49dd9e5197","resolution":{"observed_at":"2026-08-08T17:05:18.038803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.022219Z","title":"Test- time prompt tuning for zero-shot generalization in vision- language models","venue":null,"work_id":"453190fa-1cb0-4133-8bb2-a878285cc6cc","year":2022},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.708096Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:4395bd90cc27df7f950064ebb212b210c18cf66ba1e34743fae33c535abbe559","observation_id":"7a1b56f6-e1c8-4171-aa92-618e063b885e","resolution":{"observed_at":"2026-08-08T17:05:18.026390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:18.009335Z","title":"Generative modeling by estimating gradients of the data distribution","venue":null,"work_id":"ef849019-1f3f-400f-a839-e4c4e203e561","year":2019},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.711775Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:245adb18cc57f242b87855994c2a19312409e8f74857066d9e0787b9e55595f6","observation_id":"97024579-8da8-4da3-a0f9-d1b2232a3047","resolution":{"observed_at":"2026-08-08T17:05:18.013645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-08T17:05:17.715629Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.715629Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:da2ff3be1bbb880d3472fa6ad9866fd7dfe1ef7a38132406c66caa74e5ceec81","observation_id":"32ee7626-008e-48a3-8f2a-7a55156f752f","resolution":{"observed_at":"2026-08-08T17:05:17.715629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.719814Z","title":"Test-time training with self- supervision for generalization under distribution shifts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.719814Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:8cf4764687171d492b9bc9d6cff8666e7a116a7899bc3cbedd3d43079cbecf8b","observation_id":"6fce2b5b-f784-4ee3-9ab4-671ba89e7cfb","resolution":{"observed_at":"2026-08-08T17:05:17.719814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07417","last_updated":"2024-06-14T11:40:31Z","snapshot_observed_at":"2026-07-06T17:28:43.842260Z","submitted_at":"2024-02-12T05:44:10Z","title":"An Empirical Study Into What Matters for Calibrating Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07417","snapshot_observed_at":"2026-08-08T17:05:17.723662Z","title":"An empirical study into what mat- ters for calibrating vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.723662Z"},"links":{"cited_paper":"/paper/2402.07417","citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:6877f83266f9ef3918bd270cc65758a07bbd556312e75f84d3e2bcf883cd4e15","observation_id":"9f369ef1-8440-464b-a744-e670db9486d7","resolution":{"observed_at":"2026-08-08T17:05:17.723662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10726","last_updated":"2021-03-18T17:58:01Z","snapshot_observed_at":"2026-07-06T09:30:32.320227Z","submitted_at":"2020-06-18T17:55:28Z","title":"Tent: Fully Test-time Adaptation by Entropy Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10726","snapshot_observed_at":"2026-08-08T17:05:17.727647Z","title":"Tent: Fully test-time adaptation by entropy minimization","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.727647Z"},"links":{"cited_paper":"/paper/2006.10726","citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:b5c1288aa62e6e5b90cd5744d923df6cda6cb156aeab1b9d955f34b4b4ceb30a","observation_id":"c8bf3e70-11d7-4d42-8d23-8236de17512f","resolution":{"observed_at":"2026-08-08T17:05:17.727647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.988471Z","title":"Learning robust global representations by penalizing local predictive power.Advances in Neural Information Pro- cessing Systems, 32, 2019","venue":null,"work_id":"bcff2e0e-f483-47e7-85ba-3b1a745e4b3c","year":2019},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.731505Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:e9cb8896f6cc2658a5780ff50534b541fd7990adec3cbb4cde36980f10b93d19","observation_id":"3c2a8112-4c83-481a-bb06-53dc18a40b11","resolution":{"observed_at":"2026-08-08T17:05:17.992766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.976159Z","title":"Sun database: Large-scale scene recognition from abbey to zoo","venue":null,"work_id":"3c94cb2d-316f-433f-bdce-7794632f3c2a","year":2010},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.735306Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:591a33efd3d40591392271ed4189b6e803f624ea189c836f3c5f1d1d69d31e66","observation_id":"9841ecbe-6055-4ddb-8f3d-240d14a5b689","resolution":{"observed_at":"2026-08-08T17:05:17.980458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03687","last_updated":"2024-11-06T06:13:57Z","snapshot_observed_at":"2026-08-06T20:03:24.909204Z","submitted_at":"2024-11-06T06:13:57Z","title":"Beyond Model Adaptation at Test Time: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03687","snapshot_observed_at":"2026-08-08T17:05:17.738938Z","title":"Beyond model adaptation at test time: A survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.738938Z"},"links":{"cited_paper":"/paper/2411.03687","citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:5672a43da54f56ba1e5c64f9f66aaa100e8b226f156cb0682fa844762d0d3173","observation_id":"762629f4-98c0-4959-9644-2bf774d3b00a","resolution":{"observed_at":"2026-08-08T17:05:17.738938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.963253Z","title":"C-tpt: Calibrated test-time prompt tuning for vision-language mod- els via text feature dispersion","venue":null,"work_id":"6a9d9f3e-1854-4c1e-819f-80b18f1a4e71","year":null},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.742994Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:bbcae3f83b31f51951369f5ced008f1c199bdf68dc92010126e80545ca1afc37","observation_id":"be71eeab-1276-4ece-a8b7-0c42f954c613","resolution":{"observed_at":"2026-08-08T17:05:17.967668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.953094Z","title":"Memo: Test time robustness via adaptation and augmentation","venue":null,"work_id":"f20ffd3a-58f7-48f1-b12b-c6b1d235ae62","year":2022},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.747213Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:01ccdc919b035021d4dba8d25056524dcb6353e9f1075d483035fa3d1d23ff7b","observation_id":"159a8db6-b8d8-4774-8431-1cf4f38a96b7","resolution":{"observed_at":"2026-08-08T17:05:17.956515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.942784Z","title":"Memo: Test time robustness via adaptation and augmentation, 2022","venue":null,"work_id":"99571e5c-902e-4ede-a517-57ab905f7c5a","year":2022},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.750569Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:7faf882e0b455ab201a7e6a60522447f29325ea7b3725dea81e6c913ac3739cb","observation_id":"b5611b0f-38a6-49c3-8d1f-1887a6de37ab","resolution":{"observed_at":"2026-08-08T17:05:17.946308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.930802Z","title":"Test-time adaptation with clip reward for zero-shot gener- alization in vision-language models","venue":null,"work_id":"79276a92-b5a2-4c91-833b-e5b8a2c9040b","year":null},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.754082Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:e24168d3a76dace8602cabdfbab91333ddbbe5a5486f730d533af0fe7a8c180e","observation_id":"1b332cba-2a91-46cb-90c3-b1ddf649b293","resolution":{"observed_at":"2026-08-08T17:05:17.934752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18010","last_updated":"2024-02-21T06:25:33Z","snapshot_observed_at":"2026-07-06T15:34:40.619095Z","submitted_at":"2023-05-29T11:03:59Z","title":"Test-Time Adaptation with CLIP Reward for Zero-Shot Generalization in Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18010","snapshot_observed_at":"2026-08-08T17:05:17.757886Z","title":"Test-time adaptation with clip reward for zero-shot gen- eralization in vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.757886Z"},"links":{"cited_paper":"/paper/2305.18010","citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:4872a25a63e620b05c7b05306e10d28266c6abd38128e81e20476c9d6b1fb6bc","observation_id":"454c9955-0255-47fa-882a-2e9bea8ec9eb","resolution":{"observed_at":"2026-08-08T17:05:17.757886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.917484Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":"6e41671a-6e60-4996-beff-13c1de035051","year":2022},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.761903Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:89dfd4506ed73f169e4775f6dc286382e00489c36e8415ddbe3d588cc2fe4a17","observation_id":"2ea244e1-63b5-4aeb-a68f-a56e60dfad9c","resolution":{"observed_at":"2026-08-08T17:05:17.921927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:05:17.765360Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T17:05:17.765360Z"},"links":{"citing_paper":"/paper/2502.06019"},"observation_digest":"sha256:523372c55493c935f41f1cbcd7a96c8d8e70afd4aab480256674d6977781a785","observation_id":"1ec35c67-ca7a-4d5e-936f-e46e1780b083","resolution":{"observed_at":"2026-08-08T17:05:17.765360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.06019","last_updated":"2025-02-09T20:25:42Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T16:57:54.906688Z","submitted_at":"2025-02-09T20:25:42Z","title":"Noise is an Efficient Learner for Zero-Shot Vision-Language Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":27},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 3 inbound Pith citation observations for arXiv:2502.06019."}