{"as_of":"2026-08-10T16:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0dfc4533bd2c5016e34feb162a979b9f3dca64e2acd7f0516b3438143632f3a0","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T13:31:23.667869Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T06:38:20.839188Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:39:57.439115Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2502.02069","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02069","snapshot_observed_at":"2026-07-04T16:39:57.439115Z","title":"Kojima, J","venue":null,"work_id":"fccadc39-5a56-4d75-8320-aabc01833707","year":2025},"citing_paper":{"arxiv_id":"2606.23521","last_updated":"2026-06-22T16:06:11Z","snapshot_observed_at":"2026-08-09T15:36:25.067817Z","submitted_at":"2026-06-22T16:06:11Z","title":"Concordia: JIT-Compiled Persistent-Kernel Checkpointing for Fault-Tolerant LLM Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T07:18:39.176096Z"},"links":{"cited_paper":"/paper/2502.02069","citing_paper":"/paper/2606.23521"},"observation_digest":"sha256:103e878798fb74192cab137b62d97e1399195d83c62687b130d2cc6e7a7f4d76","observation_id":"513629b7-bc58-4a92-af9a-8d3b1be8e9c1","resolution":{"observed_at":"2026-07-04T11:59:51.626278Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2502.02069","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02069","snapshot_observed_at":"2026-07-04T16:39:57.439115Z","title":"Kojima, J","venue":null,"work_id":"fccadc39-5a56-4d75-8320-aabc01833707","year":2025},"citing_paper":{"arxiv_id":"2606.26457","last_updated":"2026-06-24T23:37:09Z","snapshot_observed_at":"2026-08-03T10:22:47.915806Z","submitted_at":"2026-06-24T23:37:09Z","title":"A probabilistic framework for online test-time adaptation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T00:25:16.745211Z"},"links":{"cited_paper":"/paper/2502.02069","citing_paper":"/paper/2606.26457"},"observation_digest":"sha256:57d00868346bda3148e6d7e586dac3aab3942d84079181aac26226131fb45259","observation_id":"29055660-129f-4ab6-9e1c-fa8e33b74c50","resolution":{"observed_at":"2026-07-04T16:39:57.440765Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2502.02069","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02069","snapshot_observed_at":"2026-07-04T16:39:57.439115Z","title":"Kojima, J","venue":null,"work_id":"fccadc39-5a56-4d75-8320-aabc01833707","year":2025},"citing_paper":{"arxiv_id":"2606.28142","last_updated":"2026-06-30T12:07:38Z","snapshot_observed_at":"2026-07-31T10:48:27.508062Z","submitted_at":"2026-06-26T14:40:36Z","title":"MixTTA: Low-Rank Cross-Channel Mixing for Reliable Test-Time Adaptation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-29T04:55:08.024649Z"},"links":{"cited_paper":"/paper/2502.02069","citing_paper":"/paper/2606.28142"},"observation_digest":"sha256:e2abc3289d15827524fa92de9fb350e985aa9a446cf5e385373d345f8c7a88e1","observation_id":"efe58a44-9f64-4e3c-b805-5f9cd61108d4","resolution":{"observed_at":"2026-06-29T19:13:52.848424Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2502.02069","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02069","snapshot_observed_at":"2026-07-04T16:39:57.439115Z","title":"Kojima, J","venue":null,"work_id":"fccadc39-5a56-4d75-8320-aabc01833707","year":2025},"citing_paper":{"arxiv_id":"2606.28142","last_updated":"2026-06-30T12:07:38Z","snapshot_observed_at":"2026-07-31T10:48:27.508062Z","submitted_at":"2026-06-26T14:40:36Z","title":"MixTTA: Low-Rank Cross-Channel Mixing for Reliable Test-Time Adaptation","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-01T06:38:20.839188Z"},"links":{"cited_paper":"/paper/2502.02069","citing_paper":"/paper/2606.28142"},"observation_digest":"sha256:ee8df6529c7547a489d0245f6a1d4f54f34c068f9d593af84fea5cd258f3d47e","observation_id":"79fd9eb2-89f9-45a6-881c-b20462b91680","resolution":{"observed_at":"2026-07-01T06:45:29.799839Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.02069/citation-record","integrity":"/paper/2502.02069/integrity","json":"/paper/2502.02069/citation-record.json","paper":"/paper/2502.02069"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2012.13255","last_updated":"2020-12-22T07:42:30Z","snapshot_observed_at":"2026-08-08T07:37:46.709970Z","submitted_at":"2020-12-22T07:42:30Z","title":"Intrinsic Dimensionality Explains the Effectiveness of Language Model Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.13255","snapshot_observed_at":"2026-08-09T13:31:23.310765Z","title":"In- trinsic dimensionality explains the effectiveness of language model fine-tuning","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.310765Z"},"links":{"cited_paper":"/paper/2012.13255","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:74c950273ed9c99547e6a360d8e1bd02a6a3c008f5e7f47a0ac5e40e15bbd0e0","observation_id":"c656a7c6-1b45-4e4e-b8e9-2ed8b62022ce","resolution":{"observed_at":"2026-08-09T13:31:23.310765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:26.134820Z","title":"Self-supervised 8 test-time adaptation on video data","venue":null,"work_id":"bd759d81-5750-4900-ad48-a9110816d43b","year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.316605Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:8ee9c2195c7c34b1b207fc3c053cb67575121382a5baa250066044609eda9331","observation_id":"b8e54099-8a2c-438a-bcd4-ceb08cf2e4a8","resolution":{"observed_at":"2026-08-09T13:31:26.139636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.321671Z","title":"Food-101–mining discriminative components with random forests","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.321671Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:d243806e0b85657762f44d48c9186f9df1d162805fecb1d0e73f4fb1ca316027","observation_id":"860e31d2-e41e-4837-8057-711a8650b091","resolution":{"observed_at":"2026-08-09T13:31:23.321671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:26.109533Z","title":"Parameter-free online test-time adaptation","venue":null,"work_id":"63912292-0415-470d-97d0-686bb6c174d6","year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.326336Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:8f7166c1768a735431486e083ebbf34705989febdcc30f2ccfc0154cefbfe30e","observation_id":"b92889bd-83c8-4c3c-826d-d057639f7d54","resolution":{"observed_at":"2026-08-09T13:31:26.114383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:26.094087Z","title":"Lasp: Text-to- text optimization for language-aware soft prompting of vi- sion & language models","venue":null,"work_id":"79b3ee16-b9ab-471e-b433-3d5ba403620d","year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.331225Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:c52d0c800b413f8358b1e36f5262246418002022f0f00c862e7572a1aeba3d67","observation_id":"46beb291-28ea-4ae0-940a-a4345f666d51","resolution":{"observed_at":"2026-08-09T13:31:26.098925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:26.078872Z","title":"Tinytl: Reduce memory, not parameters for efficient on-device learning","venue":null,"work_id":"b767bd51-2e85-42d2-af5d-c9d78deadbac","year":2020},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.335999Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:3669b8d8f5dc2ed1a811a0a41b73b8fa391cc74a8878d694b11882b8c5419369","observation_id":"7f2f480c-b678-4bf3-b27c-d7bf8031d400","resolution":{"observed_at":"2026-08-09T13:31:26.083702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.341304Z","title":"Conceptual 12m: Pushing web-scale image-text pre- training to recognize long-tail visual concepts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.341304Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:85a7c2be19ae8c96685961d8f7de01c79b50e73b76c9c8138faad4f73528a4fd","observation_id":"98bc1fd4-d2ac-4622-beb8-93f164b8e6eb","resolution":{"observed_at":"2026-08-09T13:31:23.341304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:26.053307Z","title":"Contrastive test-time adaptation","venue":null,"work_id":"d7327f5e-dace-4a31-b62f-bc013f565625","year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.345899Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:77a0ee22d5248d606f1c0b8789aa2cd757baf3bc4845a1c90f3dd9b3659228b3","observation_id":"28236931-2c46-494e-a513-7e41b5ec76b5","resolution":{"observed_at":"2026-08-09T13:31:26.058121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.350355Z","title":"Describing textures in the wild","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.350355Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:83706fdd037337e1f9527cf089a36b9a1492add41ff9ae70ca3db83b47d28046","observation_id":"cfbece47-d3b5-42aa-bb9c-f2909174e7c2","resolution":{"observed_at":"2026-08-09T13:31:23.350355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.354880Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.354880Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:53abfe0a351db8a59327320ad94e6dc65f1bb7222e689b01ca4c576411522c9d","observation_id":"76b15297-28df-4103-a553-db588425e185","resolution":{"observed_at":"2026-08-09T13:31:23.354880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.359533Z","title":"Parameter-efficient fine-tuning of large-scale pre-trained language models.Nature Machine In- telligence, 5(3):220–235, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.359533Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:5ff8e220b706899f19482dea4f45cec5203b1ad148bf5ecdeb9bec82743de17b","observation_id":"1b5c3e8e-ea8d-42b0-ae2b-e478ebea8fd8","resolution":{"observed_at":"2026-08-09T13:31:23.359533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-08-09T13:31:23.364399Z","title":"Clip- nav: Using clip for zero-shot vision-and-language naviga- tion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.364399Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:0dc03fb1279add8f8f6582d94600913df96743c8a55c33e157399462e0d236b9","observation_id":"d12c190c-8d2f-45ff-83d0-4fc9f528a92b","resolution":{"observed_at":"2026-08-09T13:31:23.364399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18330","last_updated":"2024-11-02T15:29:07Z","snapshot_observed_at":"2026-07-06T18:21:26.195207Z","submitted_at":"2024-05-28T16:24:47Z","title":"Frustratingly Easy Test-Time Adaptation of Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18330","snapshot_observed_at":"2026-08-09T13:31:23.369456Z","title":"Frustratingly easy test- time adaptation of vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.369456Z"},"links":{"cited_paper":"/paper/2405.18330","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:06b1bc15a2321d1f1c0a94ed182e52a47bad955cb75024c5ac19c7e9e335e23d","observation_id":"b6b6f7e6-122c-492c-a41f-f93c060fece0","resolution":{"observed_at":"2026-08-09T13:31:23.369456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:26.008517Z","title":"Diverse data augmentation with diffusions for effective test-time prompt tuning","venue":null,"work_id":"f2da4e99-bcc0-437d-8e2a-db84f9c064c7","year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.374339Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:d152d89f28d91f314ee6e971a5fcaf5f7a57bf338b85987b70c8beb500e23dd3","observation_id":"f5d9b971-dcaf-4233-bf41-57796e4d708b","resolution":{"observed_at":"2026-08-09T13:31:26.013315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.378981Z","title":"Test-time training with masked autoencoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.378981Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:3a29d4de174a48b54791b52753a9b90cff932ab4a35078a638aaa82c7deb9382","observation_id":"88770759-776c-4c47-8e2a-bf2efc3ea6f1","resolution":{"observed_at":"2026-08-09T13:31:23.378981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.983480Z","title":"Mimic before reconstruct: Enhancing masked autoencoders with feature mimicking","venue":null,"work_id":"bf6fbc59-08dc-4918-abd9-211dc999d345","year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.383681Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:46c982f3533d4fd24fffea99ff57766965d8d0be84195bc14942bd6f87d04742","observation_id":"87d1a547-d796-41b5-87dd-5bfb05240a45","resolution":{"observed_at":"2026-08-09T13:31:25.988333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12980","last_updated":"2023-07-24T17:58:06Z","snapshot_observed_at":"2026-08-08T23:43:33.914655Z","submitted_at":"2023-07-24T17:58:06Z","title":"A Systematic Survey of Prompt Engineering on Vision-Language Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12980","snapshot_observed_at":"2026-08-09T13:31:23.388282Z","title":"A systematic survey of prompt engineer- ing on vision-language foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.388282Z"},"links":{"cited_paper":"/paper/2307.12980","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:068d07d5f2706a3f29ec8a991a562b1f14d92892878c6ebec1b15e2b29b5a731","observation_id":"bbb966cf-fbbb-4db4-b73e-930bc7e284ea","resolution":{"observed_at":"2026-08-09T13:31:23.388282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.393013Z","title":"On calibration of modern neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.393013Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:025879e620dee723a7bc1647c1468de17274c2c77d0151658051fd805a7c9f2b","observation_id":"f0a00d8f-3c9d-4011-8d20-ac07a770d371","resolution":{"observed_at":"2026-08-09T13:31:23.393013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14608","last_updated":"2024-09-16T02:54:50Z","snapshot_observed_at":"2026-08-04T09:07:42.158421Z","submitted_at":"2024-03-21T17:55:50Z","title":"Parameter-Efficient Fine-Tuning for Large Models: A Comprehensive Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14608","snapshot_observed_at":"2026-08-09T13:31:23.397936Z","title":"Parameter-efficient fine-tuning for large models: A compre- hensive survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.397936Z"},"links":{"cited_paper":"/paper/2403.14608","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:32d36c24092f7bcf3f3e10854a40ae67b00fea577a2f7a45789a328f065b448c","observation_id":"007aa7bc-0c92-4002-908d-03c73b5a23e2","resolution":{"observed_at":"2026-08-09T13:31:23.397936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.957721Z","title":"Delving deep into rectifiers: Surpassing human-level perfor- mance on imagenet classification","venue":null,"work_id":"8011b4ee-8b8f-4744-b812-c53cf4459b89","year":2015},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.402679Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:ae60021498101daa7dc63c18d54ca5aa5c08484a5e63b10a69a995894ea03b77","observation_id":"f06441c7-e56a-43dc-a4b6-486a28850bf0","resolution":{"observed_at":"2026-08-09T13:31:25.962817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.942249Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"5f5c347f-cd0a-429f-894d-e337a3a12688","year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.407445Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:56d8a9ee844072a4c83d6e2da0ba3ea354b49c1520ed14cfc63ddd8e48216f14","observation_id":"aaa09c02-887c-47dc-a2ec-164f076b98ed","resolution":{"observed_at":"2026-08-09T13:31:25.947408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.412012Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.412012Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:d242f261fba1658be8ef15e8e89254387187fb8e85f8df0f65e6c425c09bcdc5","observation_id":"7c43f245-3848-4653-a1ed-c929f937952b","resolution":{"observed_at":"2026-08-09T13:31:23.412012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.416619Z","title":"The many faces of robust- ness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.416619Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:8408b647d481996e85e2b80eb38db771e9343cae7a4b9c732e55c07ea478f37e","observation_id":"c0d9f5cb-2f8b-4a76-b1de-3f342be27731","resolution":{"observed_at":"2026-08-09T13:31:23.416619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.421256Z","title":"Natural adversarial examples","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.421256Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:b37c31b587fb609d109e5142742fb5247600aee8ae1048ddc8c4589edf0c657e","observation_id":"b760ff6e-c273-4acd-8385-0063a4d513fb","resolution":{"observed_at":"2026-08-09T13:31:23.421256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06687","last_updated":"2025-07-10T16:14:55Z","snapshot_observed_at":"2026-08-10T13:39:18.221362Z","submitted_at":"2024-08-13T07:27:02Z","title":"Masked Image Modeling: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06687","snapshot_observed_at":"2026-08-09T13:31:23.425900Z","title":"Masked image mod- eling: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.425900Z"},"links":{"cited_paper":"/paper/2408.06687","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:d497109609b50200b918a64c2f38eba72ac3496c250b7041f1f9167dab0a93a4","observation_id":"30961f47-0370-45df-a454-56ff63c0dbe4","resolution":{"observed_at":"2026-08-09T13:31:23.425900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-09T13:31:23.430647Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.430647Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:2cef81f8655ff69820a9f94f5b7d335cb3f6b59fd439640c722614bee6e5f943","observation_id":"9c415931-9854-47bf-8e43-ab0af669c45c","resolution":{"observed_at":"2026-08-09T13:31:23.430647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.435633Z","title":"Scaling up visual and vision-language representa- tion learning with noisy text supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.435633Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:a4cdc6b93067e0985d32cb7e4b29c67aed65c00dac17a38017a75623dab033b7","observation_id":"fe06d9f6-0278-4dcb-9fca-124e4f52ec25","resolution":{"observed_at":"2026-08-09T13:31:23.435633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.888562Z","title":"Efficient test-time adaptation of vision-language models","venue":null,"work_id":"3d4d7388-26a2-4d58-8a01-613b67457579","year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.440326Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:2c67dad5abc2719dbb7c5d6162335c48533241583e7f6e84fb44f1202f83780e","observation_id":"eb3921de-a18f-419a-9624-a111f2a6e9f3","resolution":{"observed_at":"2026-08-09T13:31:25.893263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.873141Z","title":"Simple but effective: Clip embed- dings for embodied ai","venue":null,"work_id":"57e4b4b7-c8e8-4cad-bac3-e753d0e8a537","year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.444685Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:89cbbd782d09a6ac31000b14bd9c5a5e6462fcd1860e692e0177568f43d93d9d","observation_id":"b7278d43-f5a9-4b8d-9c19-714f7b9315cd","resolution":{"observed_at":"2026-08-09T13:31:25.878073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.449082Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.449082Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:fca38e13745edcac4f03b96a52040738f0408b7a7a2bf7b00997e4606aadb449","observation_id":"ecdfd95d-02c5-4f2b-9655-760041d931a9","resolution":{"observed_at":"2026-08-09T13:31:23.449082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10054","last_updated":"2022-02-21T09:03:34Z","snapshot_observed_at":"2026-08-09T11:23:03.445810Z","submitted_at":"2022-02-21T09:03:34Z","title":"Fine-Tuning can Distort Pretrained Features and Underperform Out-of-Distribution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.10054","snapshot_observed_at":"2026-08-09T13:31:23.453695Z","title":"Fine-tuning can distort pretrained fea- tures and underperform out-of-distribution","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.453695Z"},"links":{"cited_paper":"/paper/2202.10054","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:1e374435c57387f2c036bcb4f5c156bdaff089aba9d0f8bd653fc5e64b901063","observation_id":"6e827065-bb58-4fee-a4a4-14729789f218","resolution":{"observed_at":"2026-08-09T13:31:23.453695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03546","last_updated":"2022-04-03T03:33:43Z","snapshot_observed_at":"2026-08-01T06:14:31.660540Z","submitted_at":"2022-01-10T18:59:10Z","title":"Language-driven Semantic Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03546","snapshot_observed_at":"2026-08-09T13:31:23.458617Z","title":"Language-driven semantic seg- mentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.458617Z"},"links":{"cited_paper":"/paper/2201.03546","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:55c6a58d77d66274ccc1d94f6a963ff7e7e2c287f2c7503d7f21700f7b361c2f","observation_id":"be483f91-22c0-4d5b-a84e-f49f87d6a764","resolution":{"observed_at":"2026-08-09T13:31:23.458617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.848002Z","title":"Caltech 101","venue":null,"work_id":"dc046d1f-9ba2-4de6-82f3-0d36e9dc4c81","year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.463472Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:f82c0f112deb7845112fe9d578bbe3519d1698524d86c56eb7e178622c95341e","observation_id":"755c508f-ad3b-4a93-842f-002e8ffdd236","resolution":{"observed_at":"2026-08-09T13:31:25.853269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.468087Z","title":"A comprehensive sur- vey on test-time adaptation under distribution shifts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.468087Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:f0c425f9ae284424080dea8e73ead5241268c358605e33d9ada36ef7b9df3295","observation_id":"393dad61-98a6-41c3-96a5-873582e20ffe","resolution":{"observed_at":"2026-08-09T13:31:23.468087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.823867Z","title":"Clip-driven universal model for organ segmentation and tumor detection","venue":null,"work_id":"20371b41-3a4c-4d9e-ae48-f405d7d79c83","year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.472747Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:7047ad0cee2410125ed04a72b648af6d303d8d92bbc53cb2ae5c21deebc15c47","observation_id":"672f3c22-3404-49de-9d00-dc8fba4ad92c","resolution":{"observed_at":"2026-08-09T13:31:25.828681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.808529Z","title":"Continual-mae: Adaptive distribution masked autoencoders for continual test-time adaptation","venue":null,"work_id":"b7f90542-9aec-457c-81c8-b0713c99da5f","year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.477196Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:2e117c0b2ff35814b224de01b2cc82d191f103ac1a5c65ae474c372dd10c73b5","observation_id":"63d6d2ee-67bc-4226-89f1-61a3422e8aa2","resolution":{"observed_at":"2026-08-09T13:31:25.813511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-09T13:31:23.481614Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.481614Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:9068902196b289a7a91a777133fec94cb64a24c964991f261b279647b55799c6","observation_id":"1e55c825-6e8e-475b-b68d-21f11ceb5186","resolution":{"observed_at":"2026-08-09T13:31:23.481614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-07-06T03:16:28.287173Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-09T13:31:23.486136Z","title":"Fine-grained visual classi- fication of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.486136Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:b5fbd45865b098a4fea8385482c83a02b5e14e29bc9df51146777c39fcb562ae","observation_id":"a95d306f-5134-48cf-95e6-ea55f999043c","resolution":{"observed_at":"2026-08-09T13:31:23.486136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16414","last_updated":"2024-08-14T09:06:00Z","snapshot_observed_at":"2026-08-10T14:28:42.365294Z","submitted_at":"2023-09-28T13:08:08Z","title":"AutoCLIP: Auto-tuning Zero-Shot Classifiers for Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16414","snapshot_observed_at":"2026-08-09T13:31:23.490901Z","title":"Autoclip: Auto-tuning zero-shot classifiers for vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.490901Z"},"links":{"cited_paper":"/paper/2309.16414","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:7581fa15b0f3e6f2931e037d114cdd8937a97143cd459a4603050ec72f8c0cbb","observation_id":"c3eec347-81e5-44ea-814f-583adfed3db0","resolution":{"observed_at":"2026-08-09T13:31:23.490901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.792303Z","title":"Simple open-vocabulary object detection","venue":null,"work_id":"615cf6a9-8f3e-4357-9e23-3e46a8b11af4","year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.495421Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:82e2dddc96172a79b9bb1fdfbbf3b36e9acee01b79fd93cbe4a063883b1efe2e","observation_id":"9fbb8b84-1242-4ba1-a85e-27800ea13618","resolution":{"observed_at":"2026-08-09T13:31:25.798059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.776804Z","title":"Obtaining well calibrated probabilities using bayesian binning","venue":null,"work_id":"8b167204-5a6c-425d-8695-f2db159678ad","year":2015},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.500101Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:5164dede6c7599918af6d0a379e4016b964a68a7123fd5c6d17309d784c4d613","observation_id":"13437e99-65fe-4069-bf7a-23a4dfd2be1b","resolution":{"observed_at":"2026-08-09T13:31:25.781664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.504324Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.504324Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:c8ce1cbf69816b286be20b659e3b6b2c66d113cd0eb68add44a60987439f2734","observation_id":"5109e299-041d-43c9-bf7a-8bcb8f7cc053","resolution":{"observed_at":"2026-08-09T13:31:23.504324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.508949Z","title":"Cats and dogs","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.508949Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:106b9a2f9c7c7d92790fbccc1a9e905bfc4c6f403f19e8d62a9fc4aeca2b8c92","observation_id":"a28e0834-83e4-4b16-868a-9d075f920165","resolution":{"observed_at":"2026-08-09T13:31:23.508949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.741589Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"32b425aa-18a1-4466-9f31-fb2737824e32","year":2021},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.513487Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:188adf4a9786ba8f76ae9feb12a915e0e1b4fd0de34e3cab0897fc07ae4e61fe","observation_id":"1fb056e9-c8d7-42a4-9eba-7b3a4bf00e90","resolution":{"observed_at":"2026-08-09T13:31:25.746749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.518160Z","title":"Do imagenet classifiers generalize to im- agenet? In International conference on machine learning , pages 5389–5400","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.518160Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:0c3d8ded925d98bc54ec2130fc5267956be54cb22f39f92cab21e70b7f396bc9","observation_id":"89aac38d-e8a5-411a-bb04-8c712ba12aa4","resolution":{"observed_at":"2026-08-09T13:31:23.518160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.715825Z","title":"Conceptual captions: A cleaned, hypernymed, im- age alt-text dataset for automatic image captioning","venue":null,"work_id":"6e0b5116-eb11-4109-a23c-8d230835008b","year":2018},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.522517Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:7878a33fbb53303efe296ae9badf64ca72a8961b2baf84a8b17fb7ea53459fa2","observation_id":"8d5bb606-bcd7-45e5-9889-0dd93dd9637b","resolution":{"observed_at":"2026-08-09T13:31:25.721189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.698127Z","title":"Test- time prompt tuning for zero-shot generalization in vision- language models","venue":null,"work_id":"0612b142-2de5-4d3b-842b-f5d1b16eb90c","year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.527155Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:d03b1beaa98c18da4c6a40d07916d4a2a389970534fc19f1ee6a551dc27eb59a","observation_id":"0cfebf43-7e8c-48b0-b8df-93f3e91e5d9d","resolution":{"observed_at":"2026-08-09T13:31:25.703619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.680945Z","title":"Clipood: Generalizing clip to out-of-distributions","venue":null,"work_id":"a2fcd6fe-3f89-4af1-bcfc-b5f8b72c6d73","year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.531600Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:5a227bba3197cc46a20ed16c52ac9efbadab32e92f79ee6ae5900f29b1c7af5f","observation_id":"c4c6eaf0-f951-4000-b8c4-d507ab3be666","resolution":{"observed_at":"2026-08-09T13:31:25.686235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.663598Z","title":"Ecotta: Memory-efficient continual test-time adaptation via self-distilled regularization","venue":null,"work_id":"3c75f89f-e138-4def-93af-e0de9d73c59a","year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.536807Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:4193ef9bf6d095fc8963f698dec5868eb6ff8f61069657a4e5e6921e3851996c","observation_id":"a3e886b7-e48a-410d-a822-6b50a10f1350","resolution":{"observed_at":"2026-08-09T13:31:25.669296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-09T13:31:23.541418Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.541418Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:97d01970628b699a36d6eff4016eb4f67b5beb5848d910cad61a2bce43a87d92","observation_id":"68459d43-404f-4a13-880a-a00086a0c7f5","resolution":{"observed_at":"2026-08-09T13:31:23.541418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12952","last_updated":"2024-12-10T22:53:16Z","snapshot_observed_at":"2026-07-06T17:47:13.814205Z","submitted_at":"2024-03-19T17:54:34Z","title":"Just Shift It: Test-Time Prototype Shifting for Zero-Shot Generalization with Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12952","snapshot_observed_at":"2026-08-09T13:31:23.546339Z","title":"Just shift it: Test-time prototype shifting for zero-shot gen- eralization with vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.546339Z"},"links":{"cited_paper":"/paper/2403.12952","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:3ff207373f66de660ca8831aab998279bf5d28c8f18d36b0fde2c5e517069825","observation_id":"39f008b4-0302-443e-b9e0-d12b95eabed2","resolution":{"observed_at":"2026-08-09T13:31:23.546339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.551269Z","title":"Test-time training with self- supervision for generalization under distribution shifts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.551269Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:3fe223bd1019d640849e6c0a71e4cd670b315922afaae9e3ac8dc94cb4f22929","observation_id":"1af64f87-9b7d-4afa-a80f-0dfc2ea041cc","resolution":{"observed_at":"2026-08-09T13:31:23.551269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.630574Z","title":"Yfcc100m: The new data in multimedia research","venue":null,"work_id":"cfd62e8a-5bb8-4a7a-b2ce-7f43dcab63e2","year":2016},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.555757Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:a0a8b72f2353817b7f3a98b08010a6d0ea0736d464a67bbea610ce76f10f2c75","observation_id":"06246263-b1c5-4709-8bd2-084821a274cc","resolution":{"observed_at":"2026-08-09T13:31:25.636600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10726","last_updated":"2021-03-18T17:58:01Z","snapshot_observed_at":"2026-07-06T09:30:32.320227Z","submitted_at":"2020-06-18T17:55:28Z","title":"Tent: Fully Test-time Adaptation by Entropy Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10726","snapshot_observed_at":"2026-08-09T13:31:23.560399Z","title":"Tent: Fully test-time adaptation by entropy minimization","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.560399Z"},"links":{"cited_paper":"/paper/2006.10726","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:41f436b6c37503e92cfdae8a0d61606ff8cdcd9c57a85e1e2f7085d5daff6d5e","observation_id":"5edfcb04-232e-4527-bfaa-607a81dc0abb","resolution":{"observed_at":"2026-08-09T13:31:23.560399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.565338Z","title":"Learning robust global representations by penalizing local predictive power.Advances in Neural Information Pro- cessing Systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.565338Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:21d7741498e3ff85339ecd8893e76db799827ba077d96627cf1f105945033cde","observation_id":"962df42a-7354-4867-91e5-5c1697872170","resolution":{"observed_at":"2026-08-09T13:31:23.565338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08472","last_updated":"2021-09-17T11:21:34Z","snapshot_observed_at":"2026-07-06T11:48:42.000083Z","submitted_at":"2021-09-17T11:21:34Z","title":"ActionCLIP: A New Paradigm for Video Action Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.08472","snapshot_observed_at":"2026-08-09T13:31:23.569839Z","title":"Actionclip: A new paradigm for video action recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.569839Z"},"links":{"cited_paper":"/paper/2109.08472","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:c45db22e7ac4d20ebc304a94c089fe576bb77b22f9b805bdaab49ac6bf01d60b","observation_id":"1a11ae7e-743f-4e0d-b04e-64b1d6bc76f4","resolution":{"observed_at":"2026-08-09T13:31:23.569839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05014","last_updated":"2025-01-04T03:59:48Z","snapshot_observed_at":"2026-07-06T15:52:24.803146Z","submitted_at":"2023-07-11T05:17:42Z","title":"Test-Time Training on Video Streams","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05014","snapshot_observed_at":"2026-08-09T13:31:23.574506Z","title":"Test-time training on video streams","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.574506Z"},"links":{"cited_paper":"/paper/2307.05014","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:4e38d084177494bddc3c3c84e787160d60588fd56cfa305e73c1c2bc9d1dfe79","observation_id":"9faa5c6c-e48c-4cc3-b845-b8774ae69f1a","resolution":{"observed_at":"2026-08-09T13:31:23.574506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10163","last_updated":"2022-10-18T21:06:29Z","snapshot_observed_at":"2026-08-07T02:27:07.862492Z","submitted_at":"2022-10-18T21:06:29Z","title":"MedCLIP: Contrastive Learning from Unpaired Medical Images and Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.10163","snapshot_observed_at":"2026-08-09T13:31:23.579124Z","title":"Medclip: Contrastive learning from unpaired medical images and text","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.579124Z"},"links":{"cited_paper":"/paper/2210.10163","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:ce7f7852a63f64c0bf5d90f3113f29825ad26ffb57623d624b69c4f08a34abb5","observation_id":"bc515134-2ef0-4c9d-a8cb-eff19e78c61a","resolution":{"observed_at":"2026-08-09T13:31:23.579124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.601414Z","title":"In search of lost online test-time adap- tation: A survey","venue":null,"work_id":"f03a056d-e0b3-49b0-8a79-7b1be4cb4b22","year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.584111Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:3fadbf7bdf10aa975fa7473e694d7690eb124c55e9d78eab9ac62b4762284854","observation_id":"c30e09b1-1a0d-47ec-b43c-f4a85259063e","resolution":{"observed_at":"2026-08-09T13:31:25.606844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.588574Z","title":"Robust fine-tuning of zero-shot models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.588574Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:33d073c24b5d7d2d91b2a8320213c12736f1d8bc1c85be852c4c12081cb4f7c6","observation_id":"8c14c420-dd8c-4c71-97e6-c4ac4d7b787b","resolution":{"observed_at":"2026-08-09T13:31:23.588574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.593103Z","title":"Sun database: Large-scale scene recognition from abbey to zoo","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.593103Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:39f80673ae585d9f72dc1e6d06143706f448fc3cd571254d24a1fc51408f4932","observation_id":"2b9a9117-6b87-43ed-ab30-1408949e6775","resolution":{"observed_at":"2026-08-09T13:31:23.593103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.597604Z","title":"Any-shift prompt- ing for generalization over distributions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.597604Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:a3fed8c23eaa4f3a3717c5bcb1277cae8054115637fb5737904010090a1de97a","observation_id":"09f324a2-fe86-49f1-bd34-5533d07fe978","resolution":{"observed_at":"2026-08-09T13:31:23.597604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.601904Z","title":"Parameter-efficient fine-tuning for pre-trained vision models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.601904Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:9cf4e08c84767f58a6a0e488ee931c8b5bee2bef2f854c01ff4ce8b720028785","observation_id":"44e6c927-3b13-4f01-a81e-37e88b5d672b","resolution":{"observed_at":"2026-08-09T13:31:23.601904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12148","last_updated":"2023-12-19T13:31:24Z","snapshot_observed_at":"2026-07-06T17:05:19.007669Z","submitted_at":"2023-12-19T13:31:24Z","title":"Parameter-Efficient Fine-Tuning Methods for Pretrained Language Models: A Critical Review and Assessment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12148","snapshot_observed_at":"2026-08-09T13:31:23.606295Z","title":"Parameter-efficient fine-tuning methods for pretrained language models: A critical review and assess- ment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.606295Z"},"links":{"cited_paper":"/paper/2312.12148","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:12fbb8fa898c7cebf6de86f20e11d1193e6af0dbf5726d3bb978b9567c3d50b7","observation_id":"f4bb937e-9f79-4d3f-a555-88da28b9a294","resolution":{"observed_at":"2026-08-09T13:31:23.606295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07783","last_updated":"2021-11-09T17:15:38Z","snapshot_observed_at":"2026-07-06T12:08:35.761426Z","submitted_at":"2021-11-09T17:15:38Z","title":"FILIP: Fine-grained Interactive Language-Image Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07783","snapshot_observed_at":"2026-08-09T13:31:23.611194Z","title":"Filip: Fine-grained interactive language-image pre-training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.611194Z"},"links":{"cited_paper":"/paper/2111.07783","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:a72749da42ca6e858b0583ca59b30913f220336dbc957da123f8b8d30e5fd0ca","observation_id":"c3581977-98a9-40e7-8023-8914219f26dc","resolution":{"observed_at":"2026-08-09T13:31:23.611194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14119","last_updated":"2024-03-31T13:36:54Z","snapshot_observed_at":"2026-08-06T08:53:00.100346Z","submitted_at":"2024-03-21T04:08:29Z","title":"C-TPT: Calibrated Test-Time Prompt Tuning for Vision-Language Models via Text Feature Dispersion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14119","snapshot_observed_at":"2026-08-09T13:31:23.615948Z","title":"C-tpt: Calibrated test-time prompt tuning for vision- language models via text feature dispersion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.615948Z"},"links":{"cited_paper":"/paper/2403.14119","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:a46e5c142342834e2837b28b5e0fcc608823401ddb881c856150f4a8e88d96e3","observation_id":"75a2b736-9166-4320-a545-def1890bf03d","resolution":{"observed_at":"2026-08-09T13:31:23.615948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01917","last_updated":"2022-06-14T00:48:04Z","snapshot_observed_at":"2026-08-10T15:05:25.558818Z","submitted_at":"2022-05-04T07:01:14Z","title":"CoCa: Contrastive Captioners are Image-Text Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01917","snapshot_observed_at":"2026-08-09T13:31:23.621180Z","title":"Coca: Contrastive captioners are image-text foundation models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.621180Z"},"links":{"cited_paper":"/paper/2205.01917","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:6a5f60681fd814932486716ec33025e24b8def034ac7284a6ad979017e13f331","observation_id":"ab204502-80a2-4b8c-9568-70939bdf1b86","resolution":{"observed_at":"2026-08-09T13:31:23.621180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.546647Z","title":"Low-rank few-shot adaptation of vision-language models","venue":null,"work_id":"ffc8cf1a-fe4c-4136-afbd-096847dd9d1b","year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.625808Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:bb6fca25d645a7b01e2777308d01f2ce1331064ff3249fe5e55291bfff0de506","observation_id":"57785fe0-aff6-4a0a-91c5-ed92ae0a1ff9","resolution":{"observed_at":"2026-08-09T13:31:25.552755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.528337Z","title":null,"venue":null,"work_id":"348b1930-cf74-4973-81b1-09ab1ecef6ab","year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.630257Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:7fb6420c40e21d80195686eb86a419d8c1a974c5b8c87ec8948f018fd401d148","observation_id":"6526d233-98a4-426d-b051-e3606ec44d1e","resolution":{"observed_at":"2026-08-09T13:31:25.533683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.634553Z","title":"Vision-language models for vision tasks: A survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.634553Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:4bafa0579b3972c3bbe12bf8b152f8131a6c3c18225683acf178829d3e2c700e","observation_id":"47d589d3-91d1-4f9a-9ad0-423df96a0507","resolution":{"observed_at":"2026-08-09T13:31:23.634553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.497643Z","title":"Memo: Test time robustness via adaptation and augmentation","venue":null,"work_id":"b21be148-a628-46ba-ab81-3bff20aa2bb2","year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.639180Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:c347413a377a9b34754d7d5e05a5a8c90d418df48726bcb3f6bcceffca40ffcb","observation_id":"d3063c1a-b051-4f7a-b092-ee698dc11b00","resolution":{"observed_at":"2026-08-09T13:31:25.503298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-07-06T15:05:16.471478Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10512","snapshot_observed_at":"2026-08-09T13:31:23.643560Z","title":"Adalora: Adaptive budget alloca- tion for parameter-efficient fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.643560Z"},"links":{"cited_paper":"/paper/2303.10512","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:f6b2ae3a9ea1d0e368f1ffed9e84b5d6102878efd68de4a7ff02da4562f83242","observation_id":"dffebce4-ebda-46e0-8315-c3b62f374b2a","resolution":{"observed_at":"2026-08-09T13:31:23.643560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18010","last_updated":"2024-02-21T06:25:33Z","snapshot_observed_at":"2026-07-06T15:34:40.619095Z","submitted_at":"2023-05-29T11:03:59Z","title":"Test-Time Adaptation with CLIP Reward for Zero-Shot Generalization in Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18010","snapshot_observed_at":"2026-08-09T13:31:23.648287Z","title":"Test-time adaptation with clip reward for zero-shot gen- eralization in vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.648287Z"},"links":{"cited_paper":"/paper/2305.18010","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:6942ec0699d681ee49476dba0002393bbdb4cf4f0b2910ff854d182e571bc6ee","observation_id":"ef377054-74ec-4d64-bdbb-319de9ee1ab2","resolution":{"observed_at":"2026-08-09T13:31:23.648287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.653116Z","title":"Conditional prompt learning for vision-language mod- els","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.653116Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:8907a6161e17d39dc7f8744572f971b49c7696b4ad3de27245f69f4961188541","observation_id":"3a612bfc-0771-4770-9b93-b492d7b8f1de","resolution":{"observed_at":"2026-08-09T13:31:23.653116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:23.658585Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.658585Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:c93d657255da8f4e2b56f92eb99499cfcebcffd3bc54df6d6e66293d6b152779","observation_id":"ff66fd31-2d6a-474a-97f1-c619bdfab319","resolution":{"observed_at":"2026-08-09T13:31:23.658585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.453672Z","title":"Prompt-aligned gradient for prompt tuning","venue":null,"work_id":"4fde3e7c-0b58-4cee-b8c6-cca76bd7f79b","year":2023},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.663208Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:221cc31f8d5c9c3a0ba73400d135c94fc2b9c8a81a84ae0861908d3f3be69609","observation_id":"6872e3d6-2329-47f7-be40-58a96437ed28","resolution":{"observed_at":"2026-08-09T13:31:25.458349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:31:25.435881Z","title":"Melo: Low-rank adaptation is better than fine-tuning for medical image diagnosis","venue":null,"work_id":"8f4e11d7-ef53-46d8-a4e3-a57700af7cbb","year":2024},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.667869Z"},"links":{"citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:235a3c0aca629feb0192bbdd58f55a9392f88ad1847f0bf70c686b76b812e932","observation_id":"8e793c76-69ca-4379-b817-214482b3dd3b","resolution":{"observed_at":"2026-08-09T13:31:25.442615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 4 inbound Pith citation observations for arXiv:2502.02069."}