{"as_of":"2026-08-05T14:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d372ab6470658193ca8e6c710fe91a188c4daf5f3681c443fe8a2b15a552453f","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T18:55:31.923309Z","state":"measured"},{"denominator":91,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":91,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-15T11:44:19.622453Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.03740","snapshot_observed_at":"2026-07-13T14:28:05.261852Z","title":"Singular value few-shot adaptation of vision-language models.arXiv preprint arXiv:2509.03740, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.01313","last_updated":"2026-07-13T21:14:32Z","snapshot_observed_at":"2026-08-05T01:00:36.896864Z","submitted_at":"2026-04-01T18:36:47Z","title":"ScatterPrism: convergence for generative simulation and inverse problems in particle and nuclear physics","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T14:28:05.261852Z"},"links":{"cited_paper":"/paper/2509.03740","citing_paper":"/paper/2604.01313"},"observation_digest":"sha256:0b33e360de827f60dbd4a5aeec6209968b05df90b77d683a6e4520980e734e76","observation_id":"baf27cc9-8c02-47e6-abc2-ae8384a5f797","resolution":{"observed_at":"2026-07-13T14:28:05.261852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.03740","snapshot_observed_at":"2026-07-15T11:44:19.622453Z","title":"Singular value few-shot adaptation of vision-language models.arXiv preprint arXiv:2509.03740, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.01313","last_updated":"2026-07-13T21:14:32Z","snapshot_observed_at":"2026-08-05T01:00:36.896864Z","submitted_at":"2026-04-01T18:36:47Z","title":"ScatterPrism: convergence for generative simulation and inverse problems in particle and nuclear physics","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-15T11:44:19.622453Z"},"links":{"cited_paper":"/paper/2509.03740","citing_paper":"/paper/2604.01313"},"observation_digest":"sha256:4f446162ca258f73fd7809c0acb3997d786ff8b400bac3f14d42b39453268843","observation_id":"0a9495d9-c15b-4821-81e6-d1717c0a38cd","resolution":{"observed_at":"2026-07-15T11:44:19.622453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.03740/citation-record","integrity":"/paper/2509.03740/integrity","json":"/paper/2509.03740/citation-record.json","paper":"/paper/2509.03740"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:6aad52179954b78eb2c3b7d17c8b4d8efe66bc7fdb13cb912dab6970b76a1259","observation_id":"533fa2e6-2a97-4732-8b0f-eb7a2e0426e5","resolution":{"observed_at":"2026-05-18T18:56:45.916910Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intrinsic dimensionality explains the effective- ness of language model fine-tuning","venue":null,"work_id":"c7ca823b-cbc4-4434-9af8-4886a0ba0b9e","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:da1c2aaba8996ca3da7c93f8b10ee2955840557c8d6ed65c87a472da87958b76","observation_id":"c3f8c7d6-08ba-4149-a1c2-b0923d858767","resolution":{"observed_at":"2026-05-18T18:56:47.210595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dataset of breast ultrasound images.Data in brief, 28:104863","venue":null,"work_id":"2971f7e6-6b88-4aef-bd30-1d8c628b8748","year":2020},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:328af8de84585709aca806832615d1dc15a60925b0d9b6b0049e111d725f1e09","observation_id":"5bd780ac-28da-411c-9e1c-df236f5bf61e","resolution":{"observed_at":"2026-05-18T18:56:47.204613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proker: A kernel perspective on few-shot adaptation of large vision-language models","venue":null,"work_id":"d45fa24c-b55a-4483-a39a-671eda50df9e","year":2025},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:1995fe48633ce39bb50a786b7bc3a3b09e5cd1a2312c4a4492a7684f78e6a158","observation_id":"f7a7e6f8-a2b6-4899-a0e7-0ac1b7b0e47e","resolution":{"observed_at":"2026-05-18T18:56:47.213372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xcoop: Explainable prompt learning for computer- aided diagnosis via concept-guided context optimization","venue":null,"work_id":"fb12b2fb-2f29-44af-8f56-6c8ad3e9b309","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:0df728d9dcb6f9c5be52b902fbeebda963bbccdda48b6368d6177d739477ecfe","observation_id":"a7c657f1-a313-4395-832b-2c72490e374a","resolution":{"observed_at":"2026-05-18T18:56:47.216208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Making the most of text semantics to improve biomedical vision–language processing","venue":null,"work_id":"f88b303a-9d2d-490e-8447-cea71a76d257","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:d1bb39f4890365d3b893bcf892887d7d4c8e4b469426070e5c96e1e13b71d3a1","observation_id":"e1600481-7bca-4497-90d7-5522b6956893","resolution":{"observed_at":"2026-05-18T18:56:47.221616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Borkowski, Marilyn M","venue":null,"work_id":"70c377e7-2607-4dfd-90c0-2c1a6ab23701","year":2019},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:c43ecc1311941e59891a11f8b345c72d7dc3377408a1df0284d8141b74c2edd8","observation_id":"f264135b-7f71-4abe-a227-2b418334a2d0","resolution":{"observed_at":"2026-05-18T18:56:47.224047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Food-101–mining discriminative components with random forests","venue":null,"work_id":"53378af0-8fea-4a08-9724-6d0bda8b23a7","year":2014},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:864ab70c0f2e259417b3b6235bd4f2b74f70fc808f2564f7db2c702cbd92da0c","observation_id":"89e889f9-4682-4010-8ef0-6915abbec4f6","resolution":{"observed_at":"2026-05-18T18:56:47.207538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Domain-controlled prompt learning","venue":null,"work_id":"a9bc90db-e59c-48c0-8c17-965ea58dad6b","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:8fe256d1e13a310a5bfeb2c8d98cfbf6cccd4706a7ddb88b0ea82060fbe8ad1e","observation_id":"7e686aec-4dc5-49b5-8282-66ce42749e1f","resolution":{"observed_at":"2026-05-18T18:56:47.226901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Knee osteoarthritis severity grading dataset","venue":null,"work_id":"8d861c9f-6e79-48f1-9216-6736a403a7e0","year":2018},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:249162ff00ecb5736962f23f8494e63a8d7b7e5b1be66865bd2b3879d958ee23","observation_id":"7e377c8e-3d36-4d0d-ab44-3ed399f3dbfc","resolution":{"observed_at":"2026-05-18T18:56:47.218850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"gscorecam: What objects is clip looking at? InProceedings of the Asian Conference on Computer Vision, pages 1959–1975","venue":null,"work_id":"1b239923-6dc7-4363-b88e-549ee5e2da69","year":1959},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:0cf23fd08cee6adb084f682a292c2173121ca3a88dc78dc4fd8eac80871e63b5","observation_id":"ad5324b2-bca9-42d1-956d-113092f67dc9","resolution":{"observed_at":"2026-05-18T18:56:47.229799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adapt- former: Adapting vision transformers for scalable visual recognition.Advances in Neural Information Processing Systems, 35:16664–16678","venue":null,"work_id":"ae2e9cba-5852-4370-a637-12b6644dae2c","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:7e8dd20671f6128aa635771d010d7e253562f8bd32130914dd4245e2462f6e56","observation_id":"afae3172-4b95-478c-a933-adeed5e78d7d","resolution":{"observed_at":"2026-05-18T18:56:47.232827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Describing textures in the wild","venue":null,"work_id":"44bc7e8d-6f56-4f97-97e9-27dedea34088","year":2014},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:feb594874e54d248d62ec10c1e25052be06a1a4a70f698ada9dba95063a6d5bf","observation_id":"06b09df2-4f47-4ce4-b2ad-65ac6694efc6","resolution":{"observed_at":"2026-05-18T18:56:47.353160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.03368","last_updated":"2019-03-29T17:36:27Z","snapshot_observed_at":"2026-07-06T07:32:06.461067Z","submitted_at":"2019-02-09T04:18:10Z","title":"Skin Lesion Analysis Toward Melanoma Detection 2018: A Challenge Hosted by the International Skin Imaging Collaboration (ISIC)","version":2},"cited_work":{"arxiv_id":"1902.03368","doi":"10.48550/arxiv.1902.03368","metadata_source":"pith","pith_arxiv_id":"1902.03368","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Skin Lesion Analysis Toward Melanoma Detection 2018: A Challenge Hosted by the International Skin Imaging Collaboration (ISIC)","venue":"cs.CV","work_id":"a1680554-54cc-449f-aa92-0acb940cad0a","year":2019},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/1902.03368","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:2e84ddd06fe59e998601f736e736f506fc422ef4ce3f5f3aae6c7c415200bbc8","observation_id":"06c553b8-a234-4820-8fc1-d11b13efda97","resolution":{"observed_at":"2026-05-18T18:56:46.005598Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"626a8742-f2ae-4c4f-b0bf-57332d680e9a","year":2009},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:a34b6dbe80befd43f33cdd06b977e96dc176612b0354218b8b445623de3d314d","observation_id":"1faa7fc3-e9bc-4eda-a62b-fd20924fc40c","resolution":{"observed_at":"2026-05-18T18:56:47.287912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Does clip benefit visual question answering in the medical domain as much as it does in the general domain?","venue":null,"work_id":"2c121ac9-1ca2-4dfb-ba40-6836d2985eb1","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:624935823806af6fed1f01e470822ff0fce04598b4d411e299d2e69885dbed98","observation_id":"cf7df616-77bc-401a-97b4-8c0e47ead3f2","resolution":{"observed_at":"2026-05-18T18:56:47.322030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning generative visual models from few training examples: An incremental bayesian approach tested on 101 object categories","venue":null,"work_id":"18553849-69a1-4558-a674-10c12c1e6ffc","year":2004},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:9242d1a43ef2886e9619f7ec5b88e587cd67e8cbe8078e0f4955558a85b7202c","observation_id":"5c29083d-9b4c-4835-ac0b-c8dfb8c3735c","resolution":{"observed_at":"2026-05-18T18:56:47.350251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05916","last_updated":"2024-03-29T03:40:47Z","snapshot_observed_at":"2026-07-06T16:30:00.114521Z","submitted_at":"2023-10-09T17:59:04Z","title":"Interpreting CLIP's Image Representation via Text-Based Decomposition","version":4},"cited_work":{"arxiv_id":"2310.05916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05916","snapshot_observed_at":"2026-06-29T18:53:51.518085Z","title":"arXiv preprint arXiv:2310.05916 , year=","venue":null,"work_id":"6f05eb6e-ec45-4976-b969-554c4549e425","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2310.05916","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:10fcfde48e9b980b04f157d30154de5d11ca34a12bb1c68f17f7396baf207edc","observation_id":"3de5c3cf-6734-4c7e-9a89-c8653d1bf5e7","resolution":{"observed_at":"2026-05-18T18:56:45.986297Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clip-adapter: Better vision-language models with feature adapters.International Journal of Computer Vision, 132(2):581–595","venue":null,"work_id":"62f08d41-45a1-4c34-a525-cba3b3144f75","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:c3af89a39c8556d3d2f74acc6ef48d284f8f157b590818e5f8de0cd05484e3ad","observation_id":"09320d8d-2820-446e-a2ef-006b27c87890","resolution":{"observed_at":"2026-05-18T18:56:47.318883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet auto-annotation with segmentation propagation.International Journal of Computer Vision, 110(3):328–348","venue":null,"work_id":"8cc0bb19-35b7-42a4-a217-f494ebb83d4a","year":2014},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:042bbf06a7fd7864883324e0021d04f77089a103bce0763e0467c4202e44940a","observation_id":"cd24fc75-0ef6-436e-bf35-98e08c13cdce","resolution":{"observed_at":"2026-05-18T18:56:47.325531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Parameter-efficient transfer learning with diff pruning","venue":null,"work_id":"adc7123d-54c7-448d-94db-30087bd5273d","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:66a2ee85c023a92c43cfb7f9de5b33ceab322b7059b8ba5cf32c05dff3c2dbb3","observation_id":"ff3c9753-c886-4443-bfef-71701186333c","resolution":{"observed_at":"2026-05-18T18:56:47.301065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification.J-STARS, 12(7):2217–2226","venue":null,"work_id":"2b562199-3961-4ef6-9701-8c2ee2680cea","year":2019},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:020febad0d86c7d5810f85956181216addf342d946d5723ef12aa59ce75850fa","observation_id":"6643ec43-d686-4ae1-b4b6-acad9d134468","resolution":{"observed_at":"2026-05-18T18:56:47.242050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The many faces of robustness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":"e2ab86bd-e56e-4cba-a3f4-8d55772fed76","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:f532942b55028c352c8afb72876bb4d5298749de2da068ce9f0e613b21183a8b","observation_id":"2a0abd87-4ade-406f-a9e5-8d9c2a3d2105","resolution":{"observed_at":"2026-05-18T18:56:47.269137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Natural adversarial examples","venue":null,"work_id":"ef5db202-2583-4f39-b5f6-2b536b6c611f","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:a2ffc8cbc481a84d374aed3b0d6fab34114b98d459c3096baf6526b80e42020f","observation_id":"7e64ccd8-cc37-4477-8870-f72972af9a48","resolution":{"observed_at":"2026-05-18T18:56:47.304103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nxmtransformer: semi-structured sparsification for natural language understanding via admm.Advances in neural information processing systems, 34: 1818–1830","venue":null,"work_id":"bdcf259c-d7ab-4d3b-9b4b-549584b35eb2","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:637cc10e3a1e40a5108b66244432e1377053252aed0ca2c556200580e7984500","observation_id":"a6f78296-1742-41c6-952e-951b39fd0229","resolution":{"observed_at":"2026-05-18T18:56:47.250902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Parameter-efficient transfer learning for nlp","venue":null,"work_id":"9bf15398-914e-4009-a697-7f47778450ec","year":2019},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:4afa3d8237cf2fb4c72ccd7607e6937f232acd643f63f3353735243b2b106706","observation_id":"ff141ef5-a5b6-4053-82d2-c7e61a7fe838","resolution":{"observed_at":"2026-05-18T18:56:47.291333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"25554bdc-ad4e-4740-a325-6b1a85176ade","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:fec9b9595d7f7ee02864fbe5325d24bcfd23d8f4d29150221cc89f4b58485d51","observation_id":"0e94d59a-5196-450f-b1c0-b81017d33df0","resolution":{"observed_at":"2026-05-18T18:56:47.294577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lp++: A surprisingly strong linear probe for few-shot clip","venue":null,"work_id":"d36cdbf3-1ba3-4313-a8c0-9a8ba97984fe","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:f85e505c1490a2abb445a629941554984a05266d5808f1b13621e187ee5dec5c","observation_id":"5db304b2-26a3-4684-b42a-a4b648a4d4e3","resolution":{"observed_at":"2026-05-18T18:56:47.244975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision transformer and explainable transfer learning models for auto detection of kidney cyst, stone and tumor from ct-radiography.Scientific Reports, 12(1):1–14","venue":null,"work_id":"b2463c29-59d4-44f4-93c3-159be6761826","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:b00a85cef87d8dfff2092e43bc1e8e6a8e538dba3306f7defef173abae7702dc","observation_id":"d19ffe23-ef9d-4776-b362-0dfad662f787","resolution":{"observed_at":"2026-05-18T18:56:47.307575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling up visual and vision-language representation learning with noisy text supervision","venue":null,"work_id":"b10103e9-d2b4-42cc-988e-048bfec3fb55","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:248b048ecf914eb1339e96ab1ba17b7793e9fd891c3137e87b203d9a6720b9df","observation_id":"9f248b4f-9ca5-480e-8979-d96c9d015bac","resolution":{"observed_at":"2026-05-18T18:56:47.402750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual prompt tuning","venue":null,"work_id":"3ebbbac0-1d46-44bf-9d78-f3a1602493df","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:1ff9484158b7d7568e933a781875094ea30fc257c6c7a0226f26693078beb1cf","observation_id":"fc2f5acf-8726-447c-9c49-67fe7ab6a40e","resolution":{"observed_at":"2026-05-18T18:56:47.356565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compacter: Efficient low-rank hypercomplex adapter layers","venue":null,"work_id":"096dbe1b-8e7d-469d-b711-fa489b137da6","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:7e1b12f75679185d92a8acfbcc26a64f69ba5962f6c79e998cd967b046b9891d","observation_id":"2c9eb32a-2a68-46e4-a067-916104d3b9e8","resolution":{"observed_at":"2026-05-18T18:56:47.374775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-class texture analysis in colorectal cancer histology.Scientific reports, 6(1):1–11","venue":null,"work_id":"8b5739b0-9cf3-4dfa-8480-2b4097e3d109","year":2016},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:3a9427ea068a9e287f2777419375452a8b1d81109c4634d1301a19c2bdf34799","observation_id":"3857d8ed-b090-4a9e-aeff-a1b4d4081332","resolution":{"observed_at":"2026-05-18T18:56:47.406018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kermany, Michael Goldbaum, et al","venue":null,"work_id":"7d34f052-f1b9-4050-9665-1f7e9292d47c","year":2018},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:9e95d24b28ed67540d36ea939d6212f004d9a7590ecd84c2cd34347373663389","observation_id":"848acc46-63f5-455d-b75c-038a2aa792f6","resolution":{"observed_at":"2026-05-18T18:56:47.341224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Maple: Multi-modal prompt learning","venue":null,"work_id":"7fd85f7d-214c-44c5-a803-9594bf4b12f3","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:1d116fd2e3f112b365acf7fad1a1529fbde8ad792b71ae2f74dcaab6be5805f8","observation_id":"a3fb7660-8c44-4ab4-b78a-07d91a053063","resolution":{"observed_at":"2026-05-18T18:56:47.265750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-regulating prompts: Foundational model adaptation without forgetting","venue":null,"work_id":"8de62095-c484-4f53-b8aa-f49b7abe161d","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:89781d912acd38148efa0c7095ad3d0524956f08531126c9cd8d972f9930531d","observation_id":"e339d494-6064-40bc-8a42-8aa9288e9ece","resolution":{"observed_at":"2026-05-18T18:56:47.247873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Medclip-sam: Bridging text and image towards universal medical image segmentation","venue":null,"work_id":"ede98ce7-fd43-441a-b87e-8757cc6dfa24","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:92023046e6ed80070f68f15c00b02a0ec4d88e7f8d3a6e41c62b34423de2f81f","observation_id":"07a9159c-0162-459f-af3d-b3032a8304ab","resolution":{"observed_at":"2026-05-18T18:56:47.281463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Medclip-samv2: Towards universal text-driven medical image segmentation.Medical Image Analysis, page 103749","venue":null,"work_id":"9d667efd-d1c3-464d-99d7-36bcc42f7db6","year":2025},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:fc0f3e6fb7881ce6e2de3f6ac05b4cf8f79d1936147d3df89589ea12016a9ef0","observation_id":"88b295f4-746b-4068-8972-e2af30dfa4ab","resolution":{"observed_at":"2026-05-18T18:56:47.378519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Biomedcoop: Learning to prompt for biomedical vision-language models","venue":null,"work_id":"27cf78bc-85dd-4035-a2d8-4d319afe24a0","year":2025},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:07b96407e5a7470db30512033205f399a045ecf4d704d80239449eac97d3922e","observation_id":"6eaddcca-d63a-4f28-90af-e405d2d32914","resolution":{"observed_at":"2026-05-18T18:56:47.272112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"50c0433d-7cba-418a-acd1-e8d67f3cd1ae","year":2013},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:48fe284d01b6e4cbe1e713b21896299e757f803df499f6243ec1ecf9049928d6","observation_id":"f92e7d54-d7a0-48c5-b7ea-f62b4824189a","resolution":{"observed_at":"2026-05-18T18:56:47.274957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Automatic no-reference quality assessment for retinal fundus images using vessel segmentation","venue":null,"work_id":"52d8202e-9f7f-4123-b951-411152d373bb","year":2013},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:2f016432d887cb592e7f05d7939ffc57e543f06b820db45cd8f233d545417fad","observation_id":"804ac4b9-b880-45a3-95c7-c728914c3814","resolution":{"observed_at":"2026-05-18T18:56:47.371205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":"2104.08691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-07-04T14:59:55.372222Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","venue":"cs.CL","work_id":"1056ba8e-7b3f-4811-be8e-9a3ed9269acb","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:982b2c15a349a4afb820ab61d63b5a18eeb26c7e966a5be42b059fec975f63f1","observation_id":"1f86f39d-fc62-47f8-be3f-d44616a2fe8f","resolution":{"observed_at":"2026-05-18T18:56:45.944281Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Measuring the intrinsic dimension of objective landscapes","venue":null,"work_id":"cd027969-fa8a-442c-a11d-aaa9bae1373d","year":2018},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:43d4470d8d371c1bedd86fc7d36fe3d3b1ffdc14b5c5011db1a034a1a4a2e5b1","observation_id":"e9cbea95-8d88-4b83-bfa9-7f072393afc0","resolution":{"observed_at":"2026-05-18T18:56:47.382172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":"d9e0c736-e362-41c8-8d9f-cd8f477aebe2","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:1b8045f968ef1cf6f239d5dec89089199c38a7acb9915930bc4a9d9046d27acb","observation_id":"7c3c92b4-c35e-4d7f-9856-dc309bed2e3c","resolution":{"observed_at":"2026-05-18T18:56:47.359999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15647","last_updated":"2024-11-22T05:02:26Z","snapshot_observed_at":"2026-08-04T11:46:49.970828Z","submitted_at":"2023-03-28T00:06:38Z","title":"Scaling Down to Scale Up: A Guide to Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2303.15647","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.15647","snapshot_observed_at":"2026-07-01T13:55:46.477835Z","title":"Scaling down to scale up: A guide to parameter-efficient fine-tuning.arXiv preprint arXiv:2303.15647","venue":null,"work_id":"57ac9386-0e04-45d3-8cb8-7bf370819655","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2303.15647","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:04fea49d4378b99f0caa8b4a3541c27939fd7f90440a62e3c67f7dfb9d132181","observation_id":"33523daa-722b-4eb3-862f-fc3862b74efc","resolution":{"observed_at":"2026-05-18T18:56:45.955971Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling & shifting your features: A new baseline for efficient model tuning.Advances in Neural Information Processing Systems, 35:109–123","venue":null,"work_id":"c399df37-6c60-4c5f-a2d6-84cbbe2d0ef3","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:2499f6141bcf89e144ef766037d069109666dbd687eb046906b1c99a2f2d05c0","observation_id":"54b8b752-c796-4766-b965-cb93a83d2494","resolution":{"observed_at":"2026-05-18T18:56:47.367429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:546370fd095841bb56a57ad620efa648a12a5330c2e03c49d223fac6439b4aec","observation_id":"a102ab94-6038-4da3-8024-47decc624aca","resolution":{"observed_at":"2026-05-18T18:56:45.966402Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-07-06T03:16:28.287173Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":"1306.5151","doi":null,"metadata_source":"pith","pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-07-11T03:07:53.092922Z","title":"Fine-Grained Visual Classification of Aircraft","venue":"cs.CV","work_id":"ed360110-3ce4-4959-8c74-1785cd9e537d","year":2013},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:bc1696c2469713d9a586d91ba7acaa6c419752c2ac66c7b3614cd52724446978","observation_id":"559ef509-3203-4482-8681-104cec7aa161","resolution":{"observed_at":"2026-05-18T18:56:45.933854Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pissa: Principal singular values and singular vectors adaptation of large language models.Advances in Neural Information Processing Systems, 37:121038– 121072","venue":null,"work_id":"64891882-b8c2-4827-b54b-96e9d1295168","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:80e1e816123e98046d6de357f557181267b12fcb9cf02a9c08cb97e0ff03547d","observation_id":"9d8a16cc-e3e4-44bb-870d-1edd4cadbf2c","resolution":{"observed_at":"2026-05-18T18:56:47.431612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Brain tumor mri dataset","venue":null,"work_id":"e59e874e-2729-4b94-b855-bd7955c8575b","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:cb57665dab396d56689597517b6a079cb5e17f94d0af3075bfcdac1ba724d20c","observation_id":"0d89dcde-e896-4c8e-a3b3-6c1bd6e7ee2e","resolution":{"observed_at":"2026-05-18T18:56:47.392730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":"3183fc6f-7894-48bd-ae7e-742be52d5128","year":2008},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:43b8dd414d23bbfd6498fd179f2a32b8ab21e166c1db85ed30abddde38e33195","observation_id":"099d17cc-ff7f-418e-9568-957d33f24a30","resolution":{"observed_at":"2026-05-18T18:56:47.363462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cats and dogs","venue":null,"work_id":"266638aa-d69f-49fd-9159-e524ee72b234","year":2012},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:4d1a34e89fcde95707f2746809aecc7c1ee80ba51c3b68046f2d36ba2542828a","observation_id":"e5a3e79e-60c6-470c-b931-458d8bb16c04","resolution":{"observed_at":"2026-05-18T18:56:47.343904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sam-parser: Fine-tuning sam efficiently by parameter space reconstruction","venue":null,"work_id":"89023af8-2b1a-4366-9ac8-c9b0dcf2b24e","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:010d3f8ea591905593a3af3b600102de6abc0cc1bef71f79ec89b8770dc149e0","observation_id":"57344476-a5b9-4655-8890-990c062fb486","resolution":{"observed_at":"2026-05-18T18:56:47.428096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adapterfusion: Non-destructive task composition for transfer learning","venue":null,"work_id":"b6eb2c23-2165-41b4-a09c-929c24763aaf","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:2e811ec4f5e6c5bc9e414fa909d09ff717a47d35aa02f33198c2a9ce80d3b2be","observation_id":"2f8b8c00-1516-4a18-8b5a-c4a8856af946","resolution":{"observed_at":"2026-05-18T18:56:47.409357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kvasir: A multi-class image dataset for computer aided gastrointestinal disease detection","venue":null,"work_id":"071ef338-eaa1-4dbc-a3a1-3dc6abc46bf4","year":2017},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:ef167ea3f0ab7d0bef6d1f7bef16ebc50989a6438de6bf3c2e8ae634ec083627","observation_id":"9bacc35b-6a1c-4d7e-9ad8-13494526dbdb","resolution":{"observed_at":"2026-05-18T18:56:47.335223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Indian diabetic retinopathy image dataset (idrid)","venue":null,"work_id":"cdd9a66f-ea45-4fc0-95a9-3643053cc755","year":2018},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:2abb5f904f9d2e8b6812d70363eff7aaa109073af63ca0704c76218348e70036","observation_id":"f06d3db4-87b9-46b0-aaf4-2e091ccf1c4b","resolution":{"observed_at":"2026-05-18T18:56:47.332151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"3f12e730-f5de-4a93-a333-3d4c8a48fc98","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:dd4592e75fc0e76090d297a9fbb8c48a12988f5cdea7d362ca06a0d98290162a","observation_id":"20b7b154-83be-4e12-9c7e-099de07a6b0f","resolution":{"observed_at":"2026-05-18T18:56:47.315131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ae559e59-1152-41d3-9bd1-9c2f6fa9f8ca","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:e7585fbc21af67ba84b3b36c38ff9a5796eff390196881932843457675b99ab3","observation_id":"8ff708a2-cfa4-4723-8a60-f63f337c2806","resolution":{"observed_at":"2026-05-18T18:56:47.421054Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23903","last_updated":"2025-09-08T19:18:30Z","snapshot_observed_at":"2026-07-06T21:49:47.325553Z","submitted_at":"2025-06-30T14:33:44Z","title":"Grounding DINO-US-SAM: Text-Prompted Multi-Organ Segmentation in Ultrasound with LoRA-Tuned Vision-Language Models","version":3},"cited_work":{"arxiv_id":"2506.23903","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23903","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Groundingdino-us-sam: Text-prompted multi-organ segmentation in ultrasound with lora-tuned vision-language models.arXiv preprint arXiv:2506.23903","venue":null,"work_id":"a62dec88-a168-4f50-bf81-558984f35a25","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2506.23903","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:cf4d7c25174f6b09012e27f9395bc47c9421793ba7303cc568c6b4d889fd71d9","observation_id":"29388302-d5d5-42ac-aeaf-d3d24ff0706d","resolution":{"observed_at":"2026-05-18T18:56:45.939464Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning multiple visual domains with residual adapters.Advances in neural information processing systems, 30","venue":null,"work_id":"d388ec50-5100-4de4-ae62-0cbcaf2a7dec","year":2017},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:b4968e2425dcc43d7a0243feb5201d28e9f3287d8aa99305cb048af67d034eff","observation_id":"96520538-42d3-4598-a398-2305c7cd0a57","resolution":{"observed_at":"2026-05-18T18:56:47.328652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Do imagenet classifiers generalize to imagenet? InICML, pages 5389–5400","venue":null,"work_id":"2b8a7eed-1330-4332-8c6b-97aadf530d54","year":2019},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:c92752c0aaba328f5211c7a991ff58f94f8a1d9457645182cfae8497aec0d27f","observation_id":"494ba83a-a8fe-44af-b5a8-3b56be0ac8bb","resolution":{"observed_at":"2026-05-18T18:56:47.412437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":"1212.0402","doi":"10.48550/arxiv.1212.0402","metadata_source":"pith","pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","venue":"cs.CV","work_id":"5dfb46e7-e952-409d-a3c7-ba7f20aebad6","year":2012},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:4668f5f3e08ca19649a01986e7d2a40a896c720fbd686f52e01303682fb31cfe","observation_id":"8906ab95-3df8-4330-bb77-388259b533ec","resolution":{"observed_at":"2026-05-18T18:56:45.995918Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18082","last_updated":"2025-07-30T17:39:30Z","snapshot_observed_at":"2026-08-02T09:44:02.171162Z","submitted_at":"2025-07-24T04:17:06Z","title":"TextSAM-EUS: Text Prompt Learning for SAM to Accurately Segment Pancreatic Tumor in Endoscopic Ultrasound","version":3},"cited_work":{"arxiv_id":"2507.18082","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18082","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Textsam-eus: Text prompt learning for sam to accurately segment pancreatic tumor in endoscopic ultrasound","venue":null,"work_id":"e9ff42ae-2cbd-457b-aaa2-e4d149e25085","year":2025},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2507.18082","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:6b1286381fa9397e17087d66101f941cdc0a5742b6561d25d1bdfaf846e56d75","observation_id":"b31418e6-5658-4dfb-b608-ea00b4d1a65c","resolution":{"observed_at":"2026-05-18T18:56:45.976425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Singular value fine-tuning: Few-shot segmentation requires few-parameters fine-tuning.Advances in neural information processing systems, 35:37484–37496","venue":null,"work_id":"0e5bb6a9-855f-4e56-9e0d-6443e0af05a6","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:21a969371c0778a685ba1f199f30ad9dd314994d71cafda3458c125ed8bdb48f","observation_id":"355a03de-17ab-438b-91ea-a62309c57547","resolution":{"observed_at":"2026-05-18T18:56:47.297840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tahir, Muhammad E.H","venue":null,"work_id":"cc356d06-ba1d-436a-a6d9-11a5e3b61f08","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:6ddb6f9e0745c72f73f52ffcc57a8b9344fd79dd7b7db91249dc105ef3af3ed1","observation_id":"df5a1dae-dbd3-42bc-9b12-de1d5d8a7b0f","resolution":{"observed_at":"2026-05-18T18:56:47.311173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The ham10000 dataset, a large collection of multi-source dermatoscopic images of common pigmented skin lesions.Scientific data, page 180161","venue":null,"work_id":"4e508c27-5746-47c6-a2d6-77785e0bb6e0","year":2018},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:e3c5fb34979821e10df27c592b35bf0aa19b4dee80ffa2e2e03a546780d34c3c","observation_id":"42838e99-fa3f-4039-afa0-b9a5367f1c94","resolution":{"observed_at":"2026-05-18T18:56:47.399269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visualizing data using t-sne.Journal of Machine Learning Research, 9(86):2579–2605","venue":null,"work_id":"eeb6c841-2b8d-45d1-8867-09c6ac4609d2","year":2008},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:840d81734d4539215865f895482237905ee96a805f057af8d068d3f72ed4e751","observation_id":"03f9afa4-48c9-4f1d-8146-041e45b14650","resolution":{"observed_at":"2026-05-18T18:56:47.347057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning robust global representations by penalizing local predictive power","venue":null,"work_id":"ecf4de79-f488-485d-91bc-327cd349b747","year":2019},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:6fe1fb0f5e116870e204a05cbea1e1f202efd527ba687d727545403763867c66","observation_id":"af41b729-3a1f-4d52-a684-c727f05b3b30","resolution":{"observed_at":"2026-05-18T18:56:47.389438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04087","last_updated":"2024-02-06T15:45:27Z","snapshot_observed_at":"2026-07-06T17:26:19.028623Z","submitted_at":"2024-02-06T15:45:27Z","title":"A Hard-to-Beat Baseline for Training-free CLIP-based Adaptation","version":1},"cited_work":{"arxiv_id":"2402.04087","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04087","snapshot_observed_at":"2026-07-02T02:16:26.839820Z","title":"A hard-to-beat baseline for training-free clip-based adaptation","venue":null,"work_id":"e66f1a81-77d0-4425-ba54-9cd5fb06a222","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2402.04087","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:ad1582ba315e2641873dd41862c4f8915b72878a8f5661fed4ebc7cee3688549","observation_id":"3510163b-0c1e-4881-af56-20a4047bb684","resolution":{"observed_at":"2026-05-18T18:56:45.991085Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sun database: Large- scale scene recognition from abbey to zoo","venue":null,"work_id":"622c83d4-39f5-44b8-94b9-3e56773b13fa","year":2010},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:2f5bcb197d7dc3e051a6e95058ca883876076a210103ede342c182ad5a5ccd8e","observation_id":"47e6cc0f-0091-4217-bda3-6c3a2360a648","resolution":{"observed_at":"2026-05-18T18:56:47.396029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in med- ical image segmentation: A comprehensive review of traditional, deep learning and hybrid approaches","venue":null,"work_id":"cd6d2ac4-15cd-4fe2-95e1-71b17d11024a","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:c1170742c6650d25434f6d864c12e2ae1a1088ae852445ec8a207107e6dd1158","observation_id":"f5ab602a-0f48-4b9d-9200-e3ad7e12a684","resolution":{"observed_at":"2026-05-18T18:56:47.284669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual-language prompt tuning with knowledge-guided context optimization","venue":null,"work_id":"2f44f35e-6984-4b45-a3cf-6c995c64ed3d","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:b974cace8fdac54e86b6075ddd6ca27b42b09eb1dd42fd96fd62dc273598bef7","observation_id":"10250800-a55d-4352-a870-2c3a762d6421","resolution":{"observed_at":"2026-05-18T18:56:47.424576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual-language prompt tuning with knowledge-guided context optimization","venue":null,"work_id":"b7b711c3-ae6a-45e5-837b-7c2c1c8a3242","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:328769fa1d844128253a63028f7dcb90039ca6e458bc01e05e5215b8a83480e1","observation_id":"ccc4f19b-234e-4dd4-aefd-60517db83e46","resolution":{"observed_at":"2026-05-18T18:56:47.259551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tcp: Textual-based class-aware prompt tuning for visual- language model","venue":null,"work_id":"e1c9b9d7-f843-472f-bb8c-7655ef34d58a","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:7d62a3d46be8cca89a108a3da23b804af987d660a856ca01d38a3b435d48e57a","observation_id":"b484a3ea-ecfb-4502-aa04-990bb8029f37","resolution":{"observed_at":"2026-05-18T18:56:47.338267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bitfit: Simple parameter-efficient fine-tuning for transformer-based masked language-models","venue":null,"work_id":"0b8c3ade-aed3-42cc-b280-f95b813145df","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:dfc99f3e6f4064c121cf6506445f9b3ed758617889214e965745b64c0ed7fda3","observation_id":"0dfb92f4-efb6-4d72-b6cf-8cfa9ed3b615","resolution":{"observed_at":"2026-05-18T18:56:47.415789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Low-rank few-shot adaptation of vision-language models","venue":null,"work_id":"fae8a566-28ce-44aa-95a0-6e899efebb45","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:d57b4c2495b121eab2393cbdd8235d42ae7a154e51d3f72ca43f0c478540e674","observation_id":"aadc4da3-3bcf-4e96-8d0b-22be2be15e5d","resolution":{"observed_at":"2026-05-18T18:56:47.278196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-07-06T15:05:16.471478Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2303.10512","doi":"10.48550/arxiv.2303.10512","metadata_source":"pith","pith_arxiv_id":"2303.10512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","venue":"cs.CL","work_id":"6fa49657-348b-42dd-b870-8758c71af878","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2303.10512","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:57f1f6661afae91be4931bdc28a28ae1ecd204de72b535e5fc50401ffd769f29","observation_id":"52ab96e8-5928-43c6-a84d-6a19a4021378","resolution":{"observed_at":"2026-05-18T18:56:45.960924Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.03930","last_updated":"2021-11-15T04:58:28Z","snapshot_observed_at":"2026-07-31T03:05:21.352948Z","submitted_at":"2021-11-06T18:09:22Z","title":"Tip-Adapter: Training-free CLIP-Adapter for Better Vision-Language Modeling","version":2},"cited_work":{"arxiv_id":"2111.03930","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.03930","snapshot_observed_at":"2026-07-08T10:54:49.125621Z","title":"Deep sets","venue":"cs.CV","work_id":"e9b1d13c-a8ca-43ed-af63-fd1158065caf","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2111.03930","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:c9bb6d665974429a8debbd2e1dd1d1d43138e33f065f430bef68e5889cebffe1","observation_id":"a849a1f4-8681-46ac-8484-ba68e78fe3b8","resolution":{"observed_at":"2026-05-18T18:56:45.928999Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16199","last_updated":"2024-09-18T23:54:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-28T17:59:12Z","title":"LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention","version":3},"cited_work":{"arxiv_id":"2303.16199","doi":"10.48550/arxiv.2303.16199","metadata_source":"pith","pith_arxiv_id":"2303.16199","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention","venue":"cs.CV","work_id":"5c44e6f5-82ca-4461-9fc1-d630f3bfa3e1","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2303.16199","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:3e3d587d0fa39ade54e4c331562bb3efa765dbd890c2841b54013ef5f7555db5","observation_id":"40a5174e-b514-49f2-aa00-8c6b4542e7f7","resolution":{"observed_at":"2026-05-18T18:56:45.981251Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lungren, Tristan Naumann, Sheng Wang, and Hoifung Poon","venue":null,"work_id":"08dd2b3f-a9bd-4974-a1f0-8971f7a36a46","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:06ae2c441500dfc2fcaccb20d47d1c3a76df5f6e03ad6f02a8d7b4836f98cd4d","observation_id":"ca41c26c-dc8c-40e7-9617-b73f38d2ae1d","resolution":{"observed_at":"2026-05-18T18:56:47.256698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07353","last_updated":"2025-03-26T13:32:28Z","snapshot_observed_at":"2026-07-31T04:25:37.437501Z","submitted_at":"2023-12-12T15:21:57Z","title":"CLIP in Medical Imaging: A Survey","version":6},"cited_work":{"arxiv_id":"2312.07353","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.07353","snapshot_observed_at":"2026-06-29T22:34:01.827945Z","title":"Clip in medical imaging: A comprehensive survey.arXiv preprint arXiv:2312.07353","venue":null,"work_id":"1836b9f2-1d92-464e-bd67-9cee09c7ad9e","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2312.07353","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:f91495fbd5f5956eaa55a6f18b0e3c1ae4d4c2f8389ee692f0de4512c8a7327a","observation_id":"806eeee6-c2aa-4d2f-b038-901fa6512f73","resolution":{"observed_at":"2026-05-18T18:56:45.950305Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conditional prompt learning for vision-language models","venue":null,"work_id":"7e221471-a623-4b2f-867d-db641600b9d9","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:ae868a51bcfc1ec34874799a805169e88e9e791f815afca07ec801fe4a45ea58","observation_id":"4e9ca3b1-a490-4053-8039-86b405908467","resolution":{"observed_at":"2026-05-18T18:56:47.239075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to prompt for vision-language models.IJCV, 130(9):2337–2348","venue":null,"work_id":"42735762-c7f0-428b-bd1a-5a4b586763fd","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:ba31730a67d2b953ae4a0f6fa1eca13d03783c36df5c430aff412f8cb6f6b26e","observation_id":"c2cc51d0-6579-4e96-88a4-364789f79080","resolution":{"observed_at":"2026-05-18T18:56:47.385678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt-aligned gradient for prompt tuning","venue":null,"work_id":"6cbd12b8-bd62-41ee-91e6-2dfce709fb06","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:9ceca54682cb591410c23488f95e038c08775497c644c2804c3bab73d69f7c74","observation_id":"3f436a21-1d8f-405b-b6a6-050776f648fe","resolution":{"observed_at":"2026-05-18T18:56:47.235685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt-aligned gradient for prompt tuning","venue":null,"work_id":"06deaa3f-6322-43c2-b9ce-3790b71cf0df","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:6b3e9fe9290f29143a74b9a2ad2987fc1785f9077b5cc28e5057b0bab18542f4","observation_id":"8340cb08-a5da-4d24-afa8-15818451c3d6","resolution":{"observed_at":"2026-05-18T18:56:47.253761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12048","last_updated":"2024-02-19T11:02:05Z","snapshot_observed_at":"2026-08-03T19:11:44.395566Z","submitted_at":"2024-02-19T11:02:05Z","title":"Model Tailor: Mitigating Catastrophic Forgetting in Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":"2402.12048","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12048","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"a photo of a [CLASS]","venue":null,"work_id":"604649cc-7631-422b-9066-73f0113d3de8","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2402.12048","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:3f5db8b3e4c050afc85978849d99ec91a1ce754bc3de2647f11dfaba2b8f6ea6","observation_id":"67a79dec-01b7-4218-a42c-1fd1f76fbb1c","resolution":{"observed_at":"2026-05-18T18:56:45.971143Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"L\" denotes layer while “H","venue":null,"work_id":"684b3991-b0a0-4bee-ae71-23bec968dbb8","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:193a3282532314cd70ef77cf7b2703d40f5d4a0472f170c18ddf0db238a5d634","observation_id":"64d032c1-3714-4f25-bf8c-d60eab6850b5","resolution":{"observed_at":"2026-05-18T18:56:47.262907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8194.3993","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9cea223d-93a6-4a9b-9b9b-8b36cd69520f","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:d13613751a67c7b60ea4c20f642357d8a4096bd51829d29ebc956b291f4f7560","observation_id":"a87230f2-2d21-4041-ac90-83530fe0aa92","resolution":{"observed_at":"2026-05-18T18:56:46.000619Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5896.8494","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7324eac8-a9c2-492c-b8eb-93643d861c83","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:d4ace3b6de757104c898ceafc9eabdd6afaeb3e8e9d4497e0069fda2d462964a","observation_id":"cb6afaba-a9dc-477b-8248-38c532fc32df","resolution":{"observed_at":"2026-05-18T18:56:45.922830Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:23:10.158908Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":1,"unresolved":0,"verified_exact":16,"verified_fuzzy":70},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 2 inbound Pith citation observations for arXiv:2509.03740."}