Pith. sign in

Paper Citation Record · LEDGER

Visual Classification via Description from Large Language Models

As of 17 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 30 inbound Pith citation observations for arXiv:2210.07183.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2210.07183 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 30 of 30 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 30 of 30 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-15T20:24:33.568302Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T21:00:08.502290Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 74974d8f-5359-492e-bc3e-a42db453b993 · inbound

ViperGPT: Visual Inference via Python Execution for Reasoning cites this paper.

ViperGPT: Visual Inference via Python Execution for Reasoning Visual Classification via Description from Large Language Models

Reference 38

Resolution
verified exact
arxiv_id, observed 2026-05-17T18:15:14.449994Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-05-17T18:15:14.382011Z digest=sha256:f2ae29855ca8d2ebfff9123b6fad5fe253ec777df431faf6dedcd8ab92c53626

Observation 1a14cca6-b5fe-41f4-b4cd-46750865a1bb · inbound

Verbalized Representation Learning for Interpretable Few-Shot Generalization cites this paper.

Verbalized Representation Learning for Interpretable Few-Shot Generalization Visual Classification via Description from Large Language Models

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-12T11:42:40.207970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T11:42:40.207970Z digest=sha256:9eb94e373088736e706396b70d0806ad6cd514c465417a9deae9f905c2ae82f4

Observation ee22d62d-df0f-4d87-aa44-982c70adb750 · inbound

Language Model as Visual Explainer cites this paper.

Language Model as Visual Explainer Visual Classification via Description from Large Language Models

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-11T20:07:35.133678Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:07:35.133678Z digest=sha256:f0050798c914af12001a20ca7d0a5065a26896a24a30b2980a7424fc404a113a

Observation 44ee8ae4-0873-44d5-8e47-430eec3f5589 · inbound

MultiEYE: Dataset and Benchmark for OCT-Enhanced Retinal Disease Recognition from Fundus Images cites this paper.

MultiEYE: Dataset and Benchmark for OCT-Enhanced Retinal Disease Recognition from Fundus Images Visual Classification via Description from Large Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-11T17:09:44.721556Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T17:09:44.721556Z digest=sha256:bb52677850cb08c0f8848a324a33fe059cce9013a1fe9f8fdceb6210620a7a94

Observation b4b4a2e8-f7fa-4374-86e3-cc06478a58be · inbound

UniMed-CLIP: Towards a Unified Image-Text Pretraining Paradigm for Diverse Medical Imaging Modalities cites this paper.

UniMed-CLIP: Towards a Unified Image-Text Pretraining Paradigm for Diverse Medical Imaging Modalities Visual Classification via Description from Large Language Models

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-11T15:59:08.994498Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T15:59:08.994498Z digest=sha256:667d3c3a0c2f1ef074224316226247366394ff23312287c8e5c4752e510a70f1

Observation 754a9dd9-9b81-4a44-9707-b89ef1b36d49 · inbound

Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP cites this paper.

Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP Visual Classification via Description from Large Language Models

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-11T15:05:08.013636Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T15:05:08.013636Z digest=sha256:86f37d4972d131098fe800eeb9f79e0b901eeed1504138aa9c07bf772853248b

Observation 64612c1f-0577-43dd-be12-ab3b7620beba · inbound

Real Classification by Description: Extending CLIP's Limits of Part Attributes Recognition cites this paper.

Real Classification by Description: Extending CLIP's Limits of Part Attributes Recognition Visual Classification via Description from Large Language Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-11T12:42:01.165695Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T12:42:01.165695Z digest=sha256:d179d533031c28bf0d1a0150a61bd2795e98f96830405a5f426a25396d1c9a26

Observation edaf297d-a029-41a3-9e98-bb78424fb6a3 · inbound

Relation-aware Hierarchical Prompt for Open-vocabulary Scene Graph Generation cites this paper.

Relation-aware Hierarchical Prompt for Open-vocabulary Scene Graph Generation Visual Classification via Description from Large Language Models

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-11T01:05:22.221097Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T01:05:22.221097Z digest=sha256:b0a4e0785d6e3c792d577eb40aa12ac7465b049da1cdc34ac0c5890c05d30826

Observation bb2999e5-895f-4ec6-9038-8bdd94e5e75c · inbound

MoE$^2$: Optimizing Collaborative Inference for Edge Large Language Models cites this paper.

MoE$^2$: Optimizing Collaborative Inference for Edge Large Language Models Visual Classification via Description from Large Language Models

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-10T20:13:14.732841Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T20:13:14.732841Z digest=sha256:a3c2d885c59a4724cce058ff38a2ae8a7fd1122cf3eb60b6b46ce2e199ecb439

Observation 6c6d9aa8-c2d9-47fa-b682-8f83f4d782bb · inbound

Multi-aspect Knowledge Distillation with Large Language Model cites this paper.

Multi-aspect Knowledge Distillation with Large Language Model Visual Classification via Description from Large Language Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-10T16:19:28.974014Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T16:19:28.974014Z digest=sha256:ac147abbfa121ed118771f2b086e367847358c5b56e7001843b8aebcd1782950

Observation ea610073-000b-4327-ba26-ada77a53eab5 · inbound

From Local Details to Global Context: Advancing Vision-Language Models with Attention-Based Selection cites this paper.

From Local Details to Global Context: Advancing Vision-Language Models with Attention-Based Selection Visual Classification via Description from Large Language Models

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-15T20:24:33.568302Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:24:33.568302Z digest=sha256:3d532b6c665bc763ed696586fc49dac4cad8beb73d55daed2496c346172a7029

Observation f808442f-9952-4bab-9d97-07075c534c09 · inbound

Debiasing CLIP: Interpreting and Correcting Bias in Attention Heads cites this paper.

Debiasing CLIP: Interpreting and Correcting Bias in Attention Heads Visual Classification via Description from Large Language Models

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T14:53:09.145035Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:53:09.145035Z digest=sha256:5952131f2932536dafb78a38e11de6cff59cb9c5e8840ece55e1f2188611e503

Observation 2da2f1be-3ff0-417d-93fa-f98322fce90d · inbound

EvdCLIP: Improving Vision-Language Retrieval with Entity Visual Descriptions from Large Language Models cites this paper.

EvdCLIP: Improving Vision-Language Retrieval with Entity Visual Descriptions from Large Language Models Visual Classification via Description from Large Language Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T14:32:38.557404Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:32:38.557404Z digest=sha256:b229e2f9be2b63b41874db02a950ca442589d316d34f11a7908074438ac0d139

Observation a3526ea1-c501-4ef2-83c6-287944eeb2ac · inbound

Improving Recommendation Fairness without Sensitive Attributes Using Multi-Persona LLMs cites this paper.

Improving Recommendation Fairness without Sensitive Attributes Using Multi-Persona LLMs Visual Classification via Description from Large Language Models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T14:18:42.396007Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:18:42.396007Z digest=sha256:2f80844b1392820b248be479636f85d2abb802ac706491f344e509cc2224ea57

Observation d21fe554-45c5-4153-ac4d-f257fae3698e · inbound

GeoVision Labeler: Zero-Shot Geospatial Classification with Vision and Language Models cites this paper.

GeoVision Labeler: Zero-Shot Geospatial Classification with Vision and Language Models Visual Classification via Description from Large Language Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T12:32:30.129101Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:32:30.129101Z digest=sha256:5dc7de091107b84b8c71b94db4a2f28e58f5e33597bf793eba6eb5434cadb6e2

Observation 1d8720a8-38d4-4b3a-8478-00c46d016f16 · inbound

Multi-modal Mutual-Guidance Conditional Prompt Learning for Vision-Language Models cites this paper.

Multi-modal Mutual-Guidance Conditional Prompt Learning for Vision-Language Models Visual Classification via Description from Large Language Models

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:47.103905Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:47.103905Z digest=sha256:3c84dff967d9302d21a5fd35417ce88c1b63696c239bda3b3071687bd8bb6380

Observation 1002a0ea-1397-4d72-809d-8b9e051199df · inbound

CatchPhrase: EXPrompt-Guided Encoder Adaptation for Audio-to-Image Generation cites this paper.

CatchPhrase: EXPrompt-Guided Encoder Adaptation for Audio-to-Image Generation Visual Classification via Description from Large Language Models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-15T18:13:42.198876Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T18:13:42.198876Z digest=sha256:1d5ecb491c426e16860c3166f5aaa31d0dd58b3e0fbca900fe0f7c7060744c0e

Observation fdcc39e7-9602-4913-a90a-1fd53e99420e · inbound

Enhancing Zero-Shot Brain Tumor Subtype Classification via Fine-Grained Patch-Text Alignment cites this paper.

Enhancing Zero-Shot Brain Tumor Subtype Classification via Fine-Grained Patch-Text Alignment Visual Classification via Description from Large Language Models

Reference 91

Resolution
unresolved
no resolver link, observed 2026-08-06T05:31:24.528427Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T05:31:24.528427Z digest=sha256:1d94284425de81f949e5f3bbf0019bb70a1b75f58dba18fc53a31aa5309bc3c7

Observation be2961b0-4a51-4b47-995f-fc2953daa493 · inbound

Adapting Vision-Language Models Without Labels: A Comprehensive Survey cites this paper.

Adapting Vision-Language Models Without Labels: A Comprehensive Survey Visual Classification via Description from Large Language Models

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-05T23:17:06.577174Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T23:17:06.577174Z digest=sha256:1e529c8aa35ab3860f82142f7fa99c4c305cb74fd2768e63ca97d7344d9e962e

Observation 8a8e11b7-14b9-4a45-b0ee-1409b0abe7ee · inbound

Spatially Grounded Concept-Based Image Classification cites this paper.

Spatially Grounded Concept-Based Image Classification Visual Classification via Description from Large Language Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-04T11:32:50.004744Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T11:32:50.004744Z digest=sha256:fd1c224a1245fff3ba489ad1433cbdbddb29e679a2fba6150c55b5448afd23cf

Observation 91b4af39-5ad7-4eae-8e04-78c8aa4b5417 · inbound

BioVLM: Routing Prompts, Not Parameters, for Cross-Modality Generalization in Biomedical VLMs cites this paper.

BioVLM: Routing Prompts, Not Parameters, for Cross-Modality Generalization in Biomedical VLMs Visual Classification via Description from Large Language Models

Reference 5

Resolution
metadata mismatch
arxiv_id, observed 2026-05-10T05:30:58.288251Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-05-10T05:30:34.672815Z digest=sha256:cec87a5155a2d09ca626570749d97e3b0e30ffab60a6aa93da51cc335ae81492

Observation 9cdae917-3d41-4fb0-af16-3783011a9a4a · inbound

From Codebooks to VLMs: Evaluating Automated Visual Discourse Analysis for Climate Change on Social Media cites this paper.

From Codebooks to VLMs: Evaluating Automated Visual Discourse Analysis for Climate Change on Social Media Visual Classification via Description from Large Language Models

Reference 51

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T14:16:06.944181Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-05-09T22:55:33.247678Z digest=sha256:491f7dad53083d979ce549fa2694a747a447439009074da1296b688af701d5aa

Observation a1f4f199-38be-442c-890b-4493c58ec766 · inbound

Enhancing Self-Supervised Talking Head Forgery Detection via a Training-Free Dual-System Framework cites this paper.

Enhancing Self-Supervised Talking Head Forgery Detection via a Training-Free Dual-System Framework Visual Classification via Description from Large Language Models

Reference 25

Resolution
verified exact
arxiv_id, observed 2026-05-12T10:51:30.406332Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-05-08T01:23:27.355803Z digest=sha256:10c9aa7874ea0b305348bafc4b7d1dc225415a3b7b4692b982cfa3f9f253f96e

Observation 70dbb306-3be7-4ca9-b62d-4e01d935de70 · inbound

Open-SAT: LLM-Guided Query Embedding Refinement for Open-Vocabulary Object Retrieval in Satellite Imagery cites this paper.

Open-SAT: LLM-Guided Query Embedding Refinement for Open-Vocabulary Object Retrieval in Satellite Imagery Visual Classification via Description from Large Language Models

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-05-11T17:51:09.491382Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-05-08T17:00:26.012733Z digest=sha256:7c2f4d87ee38bf758facc9a2cbdeefb44b14abe3e1e2ea22490366948e15d81f

Observation 075770d9-5c3b-40e0-99be-b6180696ee69 · inbound

Language-Instructed Vision Embeddings for Controllable and Generalizable Perception cites this paper.

Language-Instructed Vision Embeddings for Controllable and Generalizable Perception Visual Classification via Description from Large Language Models

Reference 16

Resolution
verified exact
arxiv_id, observed 2026-07-04T00:49:19.244441Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-06-26T20:54:48.203293Z digest=sha256:eed611347c4e1ad444c303a0be86e3649f603d95368a7c922b9a4b733af123ba

Observation 05621dfe-8106-41eb-b934-c92a9b7b3e03 · inbound

Synergistic Dual-Branch Adaptation for Multi-modal Generalized Category Discovery cites this paper.

Synergistic Dual-Branch Adaptation for Multi-modal Generalized Category Discovery Visual Classification via Description from Large Language Models

Reference 31

Resolution
verified exact
arxiv_id, observed 2026-07-04T06:29:38.091618Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-06-26T14:23:25.485490Z digest=sha256:b635645c367aafc0d40362738553ffb8faf377402e37a6427488510078aa082b

Observation 88d988eb-7528-4297-8f39-46234549879e · inbound

Data Selection Through Iterative Self-Filtering for Vision-Language Settings cites this paper.

Data Selection Through Iterative Self-Filtering for Vision-Language Settings Visual Classification via Description from Large Language Models

Reference 209

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T09:49:44.907133Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-06-26T09:22:47.537137Z digest=sha256:bc8308432f35237878b9909abec1ecd7b9beb6ef0391d0cbf7c74eb0a37a920d

Observation a986e5b6-9c49-4907-bd3b-45f79600562b · inbound

On-Policy Self-Distillation with Sampled Demonstrations Reduces Output Diversity cites this paper.

On-Policy Self-Distillation with Sampled Demonstrations Reduces Output Diversity Visual Classification via Description from Large Language Models

Reference 230

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T21:00:08.505045Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-06-25T19:23:56.452083Z digest=sha256:148718816d71a409c3221578a9d7361c2120384b4e72300ec77045d1589a5315

Observation 0ea92e6e-af8a-41bd-8de9-8699524e2067 · inbound

AdaBoosting Text Prompts for Vision-Language Models cites this paper.

AdaBoosting Text Prompts for Vision-Language Models Visual Classification via Description from Large Language Models

Reference 25

Resolution
metadata mismatch
arxiv_id, observed 2026-07-02T16:27:08.324265Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-07-02T16:24:03.231930Z digest=sha256:ceaf0816a4d7e3925c047be923212cbdfa4b05fdc4c42687b65de9040ee6e2c7

Observation ae7ae2eb-c834-4f6b-b630-7782203ca6e6 · inbound

Controlling Embedding Spaces with Text-Conditioned Transformations cites this paper.

Controlling Embedding Spaces with Text-Conditioned Transformations Visual Classification via Description from Large Language Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-01T04:15:02.123999Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T04:15:02.123999Z digest=sha256:aeebb807526fc06333288a2907b9e8fcb90dff28a66588d0142b3635f63ba37b