{"as_of":"2026-08-11T16:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3c701083f56d01eb8be30d1a2f82d42c600fa296e9c8f2f22601a4df9ca3d22a","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:05:08.260452Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.11375/citation-record","integrity":"/paper/2412.11375/integrity","json":"/paper/2412.11375/citation-record.json","paper":"/paper/2412.11375"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.527411Z","title":null,"venue":null,"work_id":"a78bcae0-0360-4e00-8bd0-e1c58ec82a69","year":2014},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.883778Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:710f8e95110ece8ff2ca0380e2534dd0e62b0b35ed1f9e50a78b48ffff83ea22","observation_id":"6ca1057c-9b67-4779-85b4-bcfbbecfbfd7","resolution":{"observed_at":"2026-08-11T15:05:09.531716Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01253","last_updated":"2023-02-09T23:26:37Z","snapshot_observed_at":"2026-08-10T02:29:50.187262Z","submitted_at":"2022-10-03T22:21:07Z","title":"PLOT: Prompt Learning with Optimal Transport for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01253","snapshot_observed_at":"2026-08-11T15:05:07.893789Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.893789Z"},"links":{"cited_paper":"/paper/2210.01253","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:dfe95011948a0800ed03d0be8df848606d436d16e13d1aaf170334df6e474b99","observation_id":"c8585b62-2b8c-443f-9a07-4a4809c36f13","resolution":{"observed_at":"2026-08-11T15:05:07.893789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.515240Z","title":null,"venue":null,"work_id":"94960f47-3a33-4655-9983-91f3f5b4b38d","year":2014},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.902015Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:dba132f681b0eaadb70d1302880d6990ac3537ceb3f9a0a722bec121517be974","observation_id":"5300759c-f01f-4bac-ab26-10df1915989e","resolution":{"observed_at":"2026-08-11T15:05:09.519457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.496899Z","title":null,"venue":null,"work_id":"060ffeda-c195-429c-b477-06ada2509971","year":2009},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.908589Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:e0c92d86e5c06e2d3649cd5df70dcb73d99cd72ec7534caa4640cab9380646e9","observation_id":"eae31b3b-067a-423f-8ddc-b51b12648955","resolution":{"observed_at":"2026-08-11T15:05:09.502097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.473221Z","title":null,"venue":null,"work_id":"7deb9617-e82c-44ad-9933-e320d6911865","year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.914288Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:c2970e1b1af93a25744dff06cddc820d64174bec74c56f110b9d256e05ef87db","observation_id":"f8261bbb-b7b4-48e7-8864-dbb5d71e3502","resolution":{"observed_at":"2026-08-11T15:05:09.477866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.458245Z","title":null,"venue":null,"work_id":"c65e3f85-406d-46e1-886e-6c3d6f4b436e","year":2004},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.919586Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:7d29cefed50d5530ee8bebb7e3a99ec7c747ecabb68f45098d11d8b9fc0b3242","observation_id":"2827b441-7787-42a9-9f0b-29681a37397d","resolution":{"observed_at":"2026-08-11T15:05:09.462530Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.445646Z","title":null,"venue":null,"work_id":"6fdeaad7-e9cc-4e13-ad1f-ae04c82fdc7f","year":1998},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.927534Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:c5a15da2d3d98294ae4969792fd5ce01aa61ba3c34a3132afb54d2bb6a00659c","observation_id":"d7a3e251-e17d-4b9d-89f8-bf9d10b76db1","resolution":{"observed_at":"2026-08-11T15:05:09.449712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04544","last_updated":"2025-03-25T14:34:04Z","snapshot_observed_at":"2026-08-09T19:43:52.666104Z","submitted_at":"2021-10-09T11:39:30Z","title":"CLIP-Adapter: Better Vision-Language Models with Feature Adapters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04544","snapshot_observed_at":"2026-08-11T15:05:07.932695Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.932695Z"},"links":{"cited_paper":"/paper/2110.04544","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:4ab478f76e0721e376105f95cdbf9361e4204ede81e9b03c62d7cec408e1441c","observation_id":"b242c3eb-dfb5-4343-879b-ae3d24d87e66","resolution":{"observed_at":"2026-08-11T15:05:07.932695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.433894Z","title":null,"venue":null,"work_id":"db3c4cea-d7d0-4bf5-8d8b-ec431e599353","year":2017},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.937211Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:76ccfddadcd1bc886cf304ad73cfc6d2f82037e9cc6469e40fc507b5cfcef6de","observation_id":"2cd34dd7-926a-4013-940a-f01c3113123e","resolution":{"observed_at":"2026-08-11T15:05:09.437910Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.420492Z","title":null,"venue":null,"work_id":"8a37b43f-e9a5-44e8-9e1e-06b89d5b3e3f","year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.942045Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:db8e4c4aafa4e2a9c959ca6d3e25ad1c1137c7b68b0fd34e6d0dcbaa7f56452c","observation_id":"c0a6cb3d-d7f4-4e69-bc6e-df5fba908fcd","resolution":{"observed_at":"2026-08-11T15:05:09.425536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.403949Z","title":null,"venue":null,"work_id":"161eb968-91db-43cd-ae37-de813b9ef183","year":2016},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.946512Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:fd89697805b35948cda149b96209b59f9e169e3e0339492c4f2b8e735930184a","observation_id":"96109206-a7ef-474c-9cc9-0d4808b79b9f","resolution":{"observed_at":"2026-08-11T15:05:09.409365Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.388924Z","title":null,"venue":null,"work_id":"c67b1855-ac45-4972-a6e7-1204c0650e56","year":2019},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.951169Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:8a2f8730df728607dde0571919892853def519117840cdf51ad708da95d02999","observation_id":"cf328d98-84df-4ebc-b5b0-05ad0e0fad3c","resolution":{"observed_at":"2026-08-11T15:05:09.394070Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.372942Z","title":null,"venue":null,"work_id":"660ae32f-5e34-4384-a847-db64a198bed4","year":2021},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.955682Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:b85f28f3579f16b60b6ba65bb49edc31b115a127d160d8dc2002243854d70354","observation_id":"bd974234-4454-416d-ba34-91f7f6e643b8","resolution":{"observed_at":"2026-08-11T15:05:09.378013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.204749Z","title":null,"venue":null,"work_id":"afada7f8-76f9-4bca-9495-965e9416f39a","year":2021},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.960070Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:60a5e28c3d6b22fa10e7db33d432aac5d9425b5774e7e4903f8ffec8cf00dbb1","observation_id":"7fd72482-4d04-4f79-9ff9-97a5d7bdbd2d","resolution":{"observed_at":"2026-08-11T15:05:09.209130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03649","last_updated":"2022-08-22T08:45:33Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:57Z","title":"Unsupervised Prompt Learning for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03649","snapshot_observed_at":"2026-08-11T15:05:07.964634Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.964634Z"},"links":{"cited_paper":"/paper/2204.03649","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:244378847a441b7dd4d47d7790d45c21edac844b807900b6874e85873a21d927","observation_id":"adb0f7b4-2b6b-43d1-be30-1c08646a5bce","resolution":{"observed_at":"2026-08-11T15:05:07.964634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02285","last_updated":"2024-04-02T20:23:10Z","snapshot_observed_at":"2026-07-06T17:54:47.689340Z","submitted_at":"2024-04-02T20:23:10Z","title":"LP++: A Surprisingly Strong Linear Probe for Few-Shot CLIP","version":1},"cited_work":{"arxiv_id":"2404.02285","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.02285","snapshot_observed_at":"2026-08-11T15:05:08.538179Z","title":"LP++: A Surprisingly Strong Linear Probe for Few-Shot CLIP","venue":"cs.CV","work_id":"d2ad4f42-e927-4649-971d-83d93a1c8b7a","year":2024},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.970508Z"},"links":{"cited_paper":"/paper/2404.02285","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:b1827de2b5a14aa32b79e4e62547d73a254a8491c5e2514cfc4e73878954b5f1","observation_id":"4d227972-3bc1-4e2f-ab50-8ae245449a76","resolution":{"observed_at":"2026-08-11T15:05:08.543237Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.181911Z","title":null,"venue":null,"work_id":"71107abe-b627-49d6-8ca0-56d8cb9b90a7","year":2013},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.975616Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:d08af0cd69cdc633df5c15a724816f313ac523231dea29441bb307a7e2875dfd","observation_id":"9e6e4460-f8ae-4d79-b166-11e6a27f273e","resolution":{"observed_at":"2026-08-11T15:05:09.189445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.160972Z","title":null,"venue":null,"work_id":"77ed0340-d91f-4b23-aaa7-2c929ba1b7d6","year":1994},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.983179Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:f27890bd042cc24d7e56a86b04ec511abcd295faca031c51bdcf7b415172aead","observation_id":"1ae1d9b1-9d41-4759-a0ff-9c9393b3da32","resolution":{"observed_at":"2026-08-11T15:05:09.168843Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.142074Z","title":null,"venue":null,"work_id":"d371d6f6-b3d9-4395-a6d6-93fd3de22c10","year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.988858Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:8eedf7674a683921f1d75655d5adbb35ccf7832d4f28d36234fd4ec75db165f6","observation_id":"32643b72-4846-482f-b21e-db88da319ddf","resolution":{"observed_at":"2026-08-11T15:05:09.146272Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.129344Z","title":null,"venue":null,"work_id":"22e4c6e2-c17e-41f7-921c-41dd60a96fb5","year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.994033Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:88f820c8368c2c44b707ed5c3df1b9b152cdee4ac06e49d9088395f7151830c8","observation_id":"25fac29f-6fb1-4485-a8cc-463e412bbd5b","resolution":{"observed_at":"2026-08-11T15:05:09.133522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03340","last_updated":"2022-05-06T16:22:36Z","snapshot_observed_at":"2026-08-03T08:40:47.885606Z","submitted_at":"2022-05-06T16:22:36Z","title":"Prompt Distribution Learning","version":1},"cited_work":{"arxiv_id":"2205.03340","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.03340","snapshot_observed_at":"2026-08-11T15:05:08.518608Z","title":"Prompt Distribution Learning","venue":"cs.CV","work_id":"86f5120b-e3e6-44bf-9909-05bd662b3fe2","year":2022},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:07.998193Z"},"links":{"cited_paper":"/paper/2205.03340","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:fe84b2b7bc43b7024eecf8e978f80e48923e2b3b5d39311d3120c2804fad401a","observation_id":"bcaeb7db-0657-400e-b807-d95d3554bbd9","resolution":{"observed_at":"2026-08-11T15:05:08.523161Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-07-06T03:16:28.287173Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-11T15:05:08.003183Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.003183Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:68c38a74b0258076b78aa6911012ca9bb6d79170cf44281557186c72acabf23d","observation_id":"e322309a-501f-4712-bc8e-c54ac3901792","resolution":{"observed_at":"2026-08-11T15:05:08.003183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.111504Z","title":null,"venue":null,"work_id":"a51b31e7-08fd-4014-9861-270974251838","year":2024},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.009072Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:84ee91ea8152996b7825c2b9e9fb47bd13b942f301cbff753908e56699addc2c","observation_id":"57b7e57b-998e-48fd-b1ee-e20cc9a14722","resolution":{"observed_at":"2026-08-11T15:05:09.116370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07183","last_updated":"2022-12-01T17:38:37Z","snapshot_observed_at":"2026-08-08T07:53:13.926951Z","submitted_at":"2022-10-13T17:03:46Z","title":"Visual Classification via Description from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07183","snapshot_observed_at":"2026-08-11T15:05:08.013636Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.013636Z"},"links":{"cited_paper":"/paper/2210.07183","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:66d200250c5cd98b55b7d02af4a8509a2aa2ffffe7709f0d3c4543e5bcfefdd0","observation_id":"754a9dd9-9b81-4a44-9707-b89ef1b36d49","resolution":{"observed_at":"2026-08-11T15:05:08.013636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.092647Z","title":null,"venue":null,"work_id":"4a4f9bf2-2ba9-475e-bdb8-86d6bcca6389","year":2022},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.018070Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:f18472cdd73056eb1a2d236e6e90587855d475515a22f402b75b30085cbfaffd","observation_id":"ec638ef6-9e2a-4b84-8328-2b1f582eeb2e","resolution":{"observed_at":"2026-08-11T15:05:09.097595Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.073298Z","title":"F.; Xian, Y.; Gool, L","venue":null,"work_id":"d94f799f-b127-44fc-b313-7a342b047c28","year":2022},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.022974Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:0df061fb6caad61d1ef8d4a6e43b4e946759c27a69ff68bcb9e1b75cd06e13fa","observation_id":"b473d8a7-7992-4700-b181-dd6e92a646fe","resolution":{"observed_at":"2026-08-11T15:05:09.080403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.027734Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.027734Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:58c59acf536d5a34cb8cee019017518383a6966d17981e2787371efd6844824d","observation_id":"9fdc6f0c-29d4-41ae-9d12-3ac3c57a1edb","resolution":{"observed_at":"2026-08-11T15:05:08.027734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.049114Z","title":"M.; Vedaldi, A.; Zisserman, A.; and Jawahar, C","venue":null,"work_id":"8c02033a-bf77-4f1a-84e4-9b90e4b7d68e","year":2012},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.032284Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:8b9aedd756799a0e14e3ac5d2fc9756022318fde30f5908b6bed2eb6008ad65d","observation_id":"8e004a22-0c3d-409b-b984-e66090b3923d","resolution":{"observed_at":"2026-08-11T15:05:09.053562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.035815Z","title":null,"venue":null,"work_id":"5ba657d2-c566-4a7d-a679-3f6c32af9dfd","year":2019},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.038421Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:131220bfcf25964d335da691727c9998edb80355923e8d00e60804e2f48746d3","observation_id":"1fb0b94d-b035-458a-8eb3-e4a71d69eb6b","resolution":{"observed_at":"2026-08-11T15:05:09.040722Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03276","last_updated":"2020-10-07T08:57:34Z","snapshot_observed_at":"2026-08-08T13:45:18.146528Z","submitted_at":"2020-10-07T08:57:34Z","title":"ZEST: Zero-shot Learning from Text Descriptions using Textual Similarity and Visual Summarization","version":1},"cited_work":{"arxiv_id":"2010.03276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.03276","snapshot_observed_at":"2026-08-11T15:05:08.463956Z","title":"ZEST: Zero-shot Learning from Text Descriptions using Textual Similarity and Visual Summarization","venue":"cs.CL","work_id":"fb73a10b-7d78-4744-87aa-bd9c6ce3e4dc","year":2020},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.046341Z"},"links":{"cited_paper":"/paper/2010.03276","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:65d986f084b5177b8a0ba7b229977ea4d1f5e5ff8be1c7d79a2a67188adc803e","observation_id":"774d55e9-f0f1-4ee0-8769-c1fef269058c","resolution":{"observed_at":"2026-08-11T15:05:08.469004Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.024406Z","title":null,"venue":null,"work_id":"5781f5ac-e072-4ec3-8546-788583e2498a","year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.055828Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:a1a70db63a3721a7e826dd0ae8df35345b81fad3ec01f099fa58a6c4a39c6b72","observation_id":"c8fa3542-1a3b-4e4c-8baf-a8c721b1cc71","resolution":{"observed_at":"2026-08-11T15:05:09.028386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.02399","last_updated":"2023-08-10T15:31:54Z","snapshot_observed_at":"2026-08-09T02:11:40.767015Z","submitted_at":"2021-12-04T18:34:24Z","title":"VT-CLIP: Enhancing Vision-Language Models with Visual-guided Texts","version":3},"cited_work":{"arxiv_id":"2112.02399","doi":null,"metadata_source":"pith","pith_arxiv_id":"2112.02399","snapshot_observed_at":"2026-08-11T15:05:08.441116Z","title":"VT-CLIP: Enhancing Vision-Language Models with Visual-guided Texts","venue":"cs.CV","work_id":"14ac142f-0562-4746-97cf-5500ab6a2658","year":2021},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.063137Z"},"links":{"cited_paper":"/paper/2112.02399","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:a261d99ac0895f93ed941ccca293b5a3d2cf580f25514c3dfb84c6f8b60b652e","observation_id":"448d610f-2da8-4cbb-9437-a32976bbdf97","resolution":{"observed_at":"2026-08-11T15:05:08.446152Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:09.011043Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; Krueger, G.; and Sutskever, I","venue":null,"work_id":"6e3e97ce-ac66-4e97-847b-a914c81ab6be","year":2021},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.068748Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:00a7f7f2bc0c9d65492c40698e5b420e3d486723b5a8c3a6acea42c5abe97f66","observation_id":"bc921647-ba0d-4083-bdc1-df27a2895ea8","resolution":{"observed_at":"2026-08-11T15:05:09.015504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.997299Z","title":null,"venue":null,"work_id":"ac7246a6-ab89-43e8-9e57-d0b430229239","year":2019},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.072995Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:283aff2ff30ffed99a1b56e3e58210cad28c2241cbf5abd12dae69e2321cae40","observation_id":"5a524aae-7c8a-4bcf-9fd3-4c3c87f04922","resolution":{"observed_at":"2026-08-11T15:05:09.001921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.976076Z","title":"M.; Koepke, A","venue":null,"work_id":"9a33a4e0-02e7-4ce0-bbbc-cf5b6189a520","year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.078329Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:3c098a24b77c6f6070ee381339d74d1da89c9468f57f5142ff8d429f54b231e2","observation_id":"de0e5273-abe1-4d29-8402-44ad32d73c33","resolution":{"observed_at":"2026-08-11T15:05:08.982734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.961008Z","title":null,"venue":null,"work_id":"a3b81fb2-8c3a-48d0-b58f-6c1da4545038","year":2022},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.082825Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:abb620506812a0a4e9e35e6e1ad150e07df816ce72c9481aad188bb5bd06d43f","observation_id":"0467f3a2-ac30-4acf-9e6d-2f471c08b663","resolution":{"observed_at":"2026-08-11T15:05:08.965637Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.946683Z","title":"G.; Wang, Y.; Cheng, C.-Y.; Fumero, M.; and Malekshan, K","venue":null,"work_id":"91e1a10f-a660-4803-bed0-d2fc6d3d7e92","year":2022},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.089220Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:82be845598184769ff773dde413ea45a296ed42a4c88c8df20d2f3c41891bfc2","observation_id":"c45de492-20f1-4d39-b1ef-a9361fc35c0c","resolution":{"observed_at":"2026-08-11T15:05:08.951446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.933056Z","title":null,"venue":null,"work_id":"3a4c6a80-3cf2-4260-acd8-66a454d0f1e8","year":2024},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.094231Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:08198ef6db1e6778a44ef155af848a565c5c0788c61bed5715c47b938264dab5","observation_id":"bf04735d-ccea-46b1-83cc-87c81839af9b","resolution":{"observed_at":"2026-08-11T15:05:08.937876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.920206Z","title":null,"venue":null,"work_id":"1452853b-5748-472d-a533-b930195902b7","year":2022},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.099811Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:c46af2c590c01c4a729c52e49c0ad1fb256ec7b2487cf8a0c8aa29c1bcc25caa","observation_id":"aa15ec73-c638-4073-8cc7-7e57b9a082ed","resolution":{"observed_at":"2026-08-11T15:05:08.924825Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12730","last_updated":"2024-03-25T18:49:52Z","snapshot_observed_at":"2026-07-06T17:05:44.188334Z","submitted_at":"2023-12-20T02:58:25Z","title":"A Closer Look at the Few-Shot Adaptation of Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12730","snapshot_observed_at":"2026-08-11T15:05:08.109058Z","title":"B.; and Dolz, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.109058Z"},"links":{"cited_paper":"/paper/2312.12730","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:2e2b61603bb8ba79a40b503917e782288db2e20f4a0ce6e5b14eeb8aa8754101","observation_id":"58fe9695-60a8-4433-83f6-b2f3e8c1fa0d","resolution":{"observed_at":"2026-08-11T15:05:08.109058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.905622Z","title":null,"venue":null,"work_id":"2f596092-3b73-4d17-b900-3c1d8354d9b5","year":2024},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.116648Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:d950e23d3fc5b797cdbfc085260dab855b287cfc6bc6a7f2e26996e3988fe7d4","observation_id":"0655b2fb-4413-4416-a441-36554f2bf75f","resolution":{"observed_at":"2026-08-11T15:05:08.910420Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.887652Z","title":null,"venue":null,"work_id":"05d97cf3-d56f-46da-b101-216cb174a39c","year":2017},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.122853Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:96d64a7b2585da0a8b3ad9a02232c18bec9d4326b855c080869ea6c08c1d7722","observation_id":"6e8916ba-3288-4685-8217-84889a539c1d","resolution":{"observed_at":"2026-08-11T15:05:08.892733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-11T15:05:08.130920Z","title":"R.; and Shah, M","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.130920Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:2ec6b947d8dc9e4de26c12be664cb89a837dd8b29d8c728fbaa91b0edebddb44","observation_id":"edacb1b6-9af9-4fed-837f-6090f93f25c3","resolution":{"observed_at":"2026-08-11T15:05:08.130920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.870746Z","title":null,"venue":null,"work_id":"cd2cdb73-ff5d-4690-a980-467386e6419a","year":2024},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.136476Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:477150f47a944545e49092c4aa8be55da1e5c5d75815aae9a45782fe9fd63c58","observation_id":"c7c9fba8-04dd-4e8b-acc3-ecf030b86cb8","resolution":{"observed_at":"2026-08-11T15:05:08.876850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.855803Z","title":null,"venue":null,"work_id":"a22e4da3-e0f5-44ac-bda4-d79a2eeec04c","year":2021},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.141107Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:a6b7df7c66413368be4f10673cb12029264d12ae3b3ecbdd024895b534554a00","observation_id":"ace76f04-fec2-47de-a523-6dd21ef8f24b","resolution":{"observed_at":"2026-08-11T15:05:08.860386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.840632Z","title":null,"venue":null,"work_id":"9836502d-f2b5-481c-84e3-d488d4d80654","year":2024},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.146085Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:78673f747462309428ec0d7b336f1122bf53c0e9028df848b1fa50bd3b918dbd","observation_id":"952e65c2-93cc-4f61-b305-32e967d62cb9","resolution":{"observed_at":"2026-08-11T15:05:08.845602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.821349Z","title":null,"venue":null,"work_id":"65d1c0c5-de5b-465e-9bd8-b08160db5227","year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.150982Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:57d11c9fe4ee56a71485397b9fa6729cd40b692a6112b2c08664070c991f9735","observation_id":"c17a8c6e-c076-442f-a6ef-d55b730f3c60","resolution":{"observed_at":"2026-08-11T15:05:08.832132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.804323Z","title":null,"venue":null,"work_id":"07342e05-1fa8-4866-a917-df5a3859d6c5","year":2019},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.158296Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:ee3e5d5c41f7aea9e2e3cbeeb059c1c58a64f41a85c1e95cf9ff84b6b5d74378","observation_id":"35224b3b-4642-4f83-81d1-3dbce7f030ce","resolution":{"observed_at":"2026-08-11T15:05:08.810222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05046","last_updated":"2020-03-29T16:47:41Z","snapshot_observed_at":"2026-08-09T18:33:44.158007Z","submitted_at":"2019-04-10T08:05:48Z","title":"Generalizing from a Few Examples: A Survey on Few-Shot Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05046","snapshot_observed_at":"2026-08-11T15:05:08.165759Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.165759Z"},"links":{"cited_paper":"/paper/1904.05046","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:759ff3360dd2f974326acbe7142e265daeb478c88d08ca3de54aa81a25bac09c","observation_id":"fdc6dd5d-285a-4cf5-8895-87267524fd01","resolution":{"observed_at":"2026-08-11T15:05:08.165759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04050","last_updated":"2024-06-03T13:22:12Z","snapshot_observed_at":"2026-07-06T17:26:14.973632Z","submitted_at":"2024-02-06T14:53:19Z","title":"Connecting the Dots: Collaborative Fine-tuning for Black-Box Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2402.04050","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.04050","snapshot_observed_at":"2026-08-11T15:05:08.355288Z","title":"Connecting the Dots: Collaborative Fine-tuning for Black-Box Vision-Language Models","venue":"cs.LG","work_id":"075c65b3-3ce0-415e-b4dc-c0137304d07d","year":2024},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.172940Z"},"links":{"cited_paper":"/paper/2402.04050","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:a9249c60e98c7594097a9702ee9f6c4fa613d877542d8879393975c2d585561c","observation_id":"8b4f60d5-a3d4-459e-b69a-e302f83f4ce2","resolution":{"observed_at":"2026-08-11T15:05:08.363287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04087","last_updated":"2024-02-06T15:45:27Z","snapshot_observed_at":"2026-08-10T12:35:55.261809Z","submitted_at":"2024-02-06T15:45:27Z","title":"A Hard-to-Beat Baseline for Training-free CLIP-based Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04087","snapshot_observed_at":"2026-08-11T15:05:08.179560Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.179560Z"},"links":{"cited_paper":"/paper/2402.04087","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:28b6982f39476cfdec7cb2472fc1fa94e6a3ae04055a766d0bb4f9425b9ff53b","observation_id":"f1609dbb-8b44-46ea-9ecf-c3b963e2f473","resolution":{"observed_at":"2026-08-11T15:05:08.179560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.784624Z","title":null,"venue":null,"work_id":"7bd69e0b-529b-4fe2-bff8-5b4b880756e3","year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.184678Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:61b16a9b672319d2d2a893a2e36c7c4a5e7d2a0f7ba07fb5cf5365d7fc45001a","observation_id":"f924f6c4-6cdb-4307-9cce-41f494bd7aed","resolution":{"observed_at":"2026-08-11T15:05:08.790154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.768349Z","title":"A.; Oliva, A.; and Torralba, A","venue":null,"work_id":"1377a56a-5be7-4cc1-a936-e82d48e764b6","year":2010},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.190715Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:03e75b04b44bb8ab37d9e2e46a325244c0fdc30ff48f0f669c54e322a8797726","observation_id":"8e7661dc-0c1e-4050-ab93-094ad2a22333","resolution":{"observed_at":"2026-08-11T15:05:08.774506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.750827Z","title":null,"venue":null,"work_id":"bd47de78-b381-4380-bfed-5895a4558c0d","year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.198025Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:22c3f5a8095ff56c39369c8cb985c204017de4ad9c7556cc2ee63a7f24890c60","observation_id":"2dddea13-4503-4a52-b7c3-ae64d7b698b4","resolution":{"observed_at":"2026-08-11T15:05:08.756470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.737044Z","title":null,"venue":null,"work_id":"9efdb38f-b47a-4e0f-8505-c6a103f44f90","year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.202426Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:b5cd4fb87beb0cd6b20d2044aadc2f97eb860adaa81c3fea7e1481621af38e6d","observation_id":"0686062f-196d-4cb9-8856-09f7b6a5b407","resolution":{"observed_at":"2026-08-11T15:05:08.741425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.723499Z","title":null,"venue":null,"work_id":"c3192e53-ff91-4fe9-b02e-7e07c496bc83","year":2022},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.207559Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:db2fe98c3eccd95a3c4e3761c5c73e4d418bd06a546d4a2bdcc691d12ec4f601","observation_id":"58d46e1b-b777-4058-a75c-45eefc2e71dd","resolution":{"observed_at":"2026-08-11T15:05:08.728264Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.707159Z","title":null,"venue":null,"work_id":"8d313eff-ddbc-4ae4-9c68-c743720b21a5","year":2024},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.215305Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:2fdf85bda8cabdc6df8ecdd9d24b59c34df8e25bcb85279c12fc2e1208ec5dc8","observation_id":"d7ec15df-b535-4b36-a8b4-461cc64f0c3e","resolution":{"observed_at":"2026-08-11T15:05:08.712893Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07457","last_updated":"2024-01-15T04:04:47Z","snapshot_observed_at":"2026-08-10T15:56:47.146960Z","submitted_at":"2024-01-15T04:04:47Z","title":"Concept-Guided Prompt Learning for Generalization in Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07457","snapshot_observed_at":"2026-08-11T15:05:08.222986Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.222986Z"},"links":{"cited_paper":"/paper/2401.07457","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:0c04440349195ec98e871adfad358b74dc3842dcf09a6c891f0bbb7aa95f4dab","observation_id":"149ccda9-ba4c-4bdb-a47b-735cde55cbc5","resolution":{"observed_at":"2026-08-11T15:05:08.222986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07353","last_updated":"2025-03-26T13:32:28Z","snapshot_observed_at":"2026-07-31T04:25:37.437501Z","submitted_at":"2023-12-12T15:21:57Z","title":"CLIP in Medical Imaging: A Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07353","snapshot_observed_at":"2026-08-11T15:05:08.229637Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.229637Z"},"links":{"cited_paper":"/paper/2312.07353","citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:02459258a33cf16463d4636f511a5f80795598e4390eeacec6a5a77ca8c1536b","observation_id":"14c7b885-4521-4f93-a216-d30ac0f143e6","resolution":{"observed_at":"2026-08-11T15:05:08.229637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.689174Z","title":"C.; and Liu, Z","venue":null,"work_id":"d34beae1-a863-41de-9588-aa3998bc75a3","year":2022},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.236181Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:6310fbb5a0a0eba072cde76492cae2eae99c5fe2e2ca22f10183740ed8af5ed2","observation_id":"5c05361b-b0f7-43bb-8049-d18e7e013508","resolution":{"observed_at":"2026-08-11T15:05:08.695453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.667389Z","title":"C.; and Liu, Z","venue":null,"work_id":"7f48b173-1f60-4250-a7f0-22e1948ace39","year":2022},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.241788Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:361df2bfd56f5a13d5bfcabbbe5ad3b7789c2c0e4142bd7f78887716951169f3","observation_id":"9988c0d2-66f1-4829-a1ae-35e1047e878d","resolution":{"observed_at":"2026-08-11T15:05:08.675741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.648139Z","title":null,"venue":null,"work_id":"94444bff-7a73-4a84-9db7-d43cc44ffe9d","year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.246409Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:4ed1cc54c8906a52b2f106a05602d53575bfb8d5285fb94f3da032bf42b89549","observation_id":"c8d3d375-33de-4ee2-9f0d-029462d23982","resolution":{"observed_at":"2026-08-11T15:05:08.654592Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.632857Z","title":null,"venue":null,"work_id":"0ae1ba18-beff-4f5c-a3e1-55a0170537c7","year":2023},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.251176Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:7328825869aaea83670d3ce7eaa16edcb776fd18e6602b0ada8ca86bf67caab7","observation_id":"3f795ccf-7f56-40ee-8b73-595bdac5ff6a","resolution":{"observed_at":"2026-08-11T15:05:08.638338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.255255Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.255255Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:cc11b1e28b0fc8bb70c8e7342b08ec8552f309392312bcddf20e11d694cb3a80","observation_id":"6a6bd834-0dbf-4056-860d-c7e14b23560b","resolution":{"observed_at":"2026-08-11T15:05:08.255255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:05:08.260452Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T15:05:08.260452Z"},"links":{"citing_paper":"/paper/2412.11375"},"observation_digest":"sha256:8919cb649f7ff159bfe92eba535f9bad0a9c7df2bb6d3013bcca9f5c053611f7","observation_id":"4b2e9577-c0c6-4501-bdee-4a8fc35b8472","resolution":{"observed_at":"2026-08-11T15:05:08.260452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.11375","last_updated":"2024-12-16T02:03:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T14:58:06.608662Z","submitted_at":"2024-12-16T02:03:45Z","title":"Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":5,"verified_fuzzy":8},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2412.11375."}