Pith. sign in

Paper Citation Record · LEDGER

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty

As of 12 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2412.02886.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2412.02886 v3

Coverage vector

measured 30 of 30 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-11T23:02:08.705732Z

measured 30 of 30 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-12T06:34:41.77262+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

30 of 30 outbound references displayed

  • verified exact1
  • verified fuzzy17
  • unresolved12
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 6ca0cd4c-7761-4253-a829-f06c41103e0d · outbound

This paper cites Strategy for digitizing archival materials for public access, 2015-2024,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Strategy for digitizing archival materials for public access, 2015-2024,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.535148Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.445973Z digest=sha256:0fe2a1400cb03e89a120fe17e68a390f8b743dc58263a3e5d2facd6b2786075b

Observation ee2e294e-550b-4a8a-86ed-0a3f0127b655 · outbound

This paper cites DocParser: End-to-end OCR-free Information Extraction from Visually Rich Documents.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty DocParser: End-to-end OCR-free Information Extraction from Visually Rich Documents

Reference 2

Resolution
verified exact
local_arxiv, observed 2026-08-11T23:02:09.133947Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.452978Z digest=sha256:5d8b58993450dcd9154b031393096761890f137954dc02511f679e61238d76d7

Observation 5696286e-96b3-45e7-a2a4-defbe9c4f824 · outbound

This paper cites PICK: Processing Key Information Extraction from Documents using Improved Graph Learning-Convolutional Networks.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty PICK: Processing Key Information Extraction from Documents using Improved Graph Learning-Convolutional Networks

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-11T23:02:08.460068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T23:02:08.460068Z digest=sha256:5e9adfc86277ee54fe94af36d3d91ef018fadfdac421495f52f8eda5459493d1

Observation 7d46bb08-9e1e-4c54-a688-b93da39ee5e8 · outbound

This paper cites OCR-free Document Understanding Transformer.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty OCR-free Document Understanding Transformer

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-11T23:02:08.468012Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T23:02:08.468012Z digest=sha256:193e56951f15868ed68796bb25f823bcc572a6011b170e9d0b518af923aac039

Observation ddaada51-27c9-4423-8baa-4a62924036dc · outbound

This paper cites LMDX: Language Model-based Document Information Extraction and Localization.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty LMDX: Language Model-based Document Information Extraction and Localization

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-11T23:02:08.480704Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T23:02:08.480704Z digest=sha256:1bdaa9e4cc7a370a06fd0df401b3556f56104bed0f030f701633186768eb2949

Observation aaeda3a9-cb8f-4a9b-aaf4-ce8d0fcddff1 · outbound

This paper cites Information extraction from historical well records using a large language model,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Information extraction from historical well records using a large language model,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.511625Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.495646Z digest=sha256:9e5204b995826196f215edd11ad32235dc76e5cf27eda2ffa89e3cb1efea38f7

Observation 51228136-1cb1-4031-b632-da9368b3cb19 · outbound

This paper cites Automated structured data extraction from scanned document images,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Automated structured data extraction from scanned document images,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.487114Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.507479Z digest=sha256:2107a7927ea28389e6647641f6046cf03069c02690e7e376e781656e4a932d72

Observation 65d2e8b1-cfa3-4842-9cd7-1d9da1aa1a3c · outbound

This paper cites An overview of the tesseract ocr engine,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty An overview of the tesseract ocr engine,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.465952Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.518371Z digest=sha256:f2d748a0af5d471748e492f3a321288d4ae011e209454c03d32364259fafe1fd

Observation 3eafe099-70b8-48d5-8770-f311dca14b7e · outbound

This paper cites Learning transferable visual models from natural language supervision,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Learning transferable visual models from natural language supervision,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.443733Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.528030Z digest=sha256:e403128923f5b2839d423275c68bfba2c501ddaef054c9d43c10d8a917154df9

Observation 5abfa59c-abc4-4be3-b6dc-d3597252de13 · outbound

This paper cites Blip-2: Boot- strapping language-image pre-training with frozen im- age encoders and large language models,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Blip-2: Boot- strapping language-image pre-training with frozen im- age encoders and large language models,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.421613Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.536542Z digest=sha256:861bfc84bd1acd87f862ec777a4e56a45b69250be2421f7cc402380c3dee43bf

Observation b0bb2a26-ba3c-4016-ae92-9ae64e92b46e · outbound

This paper cites An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-11T23:02:08.545946Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T23:02:08.545946Z digest=sha256:6dd6ee94fce2d3b26fc3c97889f3d774d23eb51b26d50aa6bf77fed66b99d3f1

Observation 3cb48cad-f3e9-4253-b0ba-cf257a02d848 · outbound

This paper cites Vision- language models for vision tasks: A survey,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Vision- language models for vision tasks: A survey,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.400546Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.554627Z digest=sha256:cee036e230eed9ca2b0e7e46304e4739db2118614d149f3e27f242acf11d7568

Observation 6dfb464c-2c30-4ee2-97b1-74794c68b23e · outbound

This paper cites Fusecap: Leveraging large language models for enriched fused image captions,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Fusecap: Leveraging large language models for enriched fused image captions,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.379255Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.565070Z digest=sha256:feb7e3d779327fc084e3215ae0950fc9edf2b6271dd82ea592b186ea4c9733a6

Observation 9170e63a-9e74-4e09-8e5d-becabea71e97 · outbound

This paper cites BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-11T23:02:08.576948Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T23:02:08.576948Z digest=sha256:3d8eb9149d64bea2af23e9e6bbd5d5b7be51a7eca87f9c9c70afa43785e482b4

Observation 262b4d05-2d78-44fc-98e6-00f4a681e510 · outbound

This paper cites Language models are few-shot learners,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Language models are few-shot learners,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.340719Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.584878Z digest=sha256:80d347450c3adc967042126e8b659e8368f0fa57c22e90adf11a8711a86c0071

Observation 820b2e40-594f-4d63-9035-5efb8d270d2f · outbound

This paper cites MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-11T23:02:08.591033Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T23:02:08.591033Z digest=sha256:cab4291256f8a6ae54f15ed7d337c5376dffa274178466e4fa0ec27b3a1e3b4b

Observation fa5387bf-2a3c-4abc-921d-c919ec08942f · outbound

This paper cites Confidence estimation of classification based on the distribution of the neural network output layer.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Confidence estimation of classification based on the distribution of the neural network output layer

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-11T23:02:08.608807Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T23:02:08.608807Z digest=sha256:578e097791962c16b979e5b19aae06a1fff1349d24ee996d2b4240873fe739c2

Observation e9ff2103-8a00-43be-bd0b-97eae0f3d3a6 · outbound

This paper cites Consortium advancing technology for assessment of lost oil & gas wells (catalog),.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Consortium advancing technology for assessment of lost oil & gas wells (catalog),

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.319861Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.617216Z digest=sha256:41af743caa2d7f1af07f783e92087212d3d5d1658e68fd7b7f626404d121fee8

Observation d32b29c8-e938-48ac-9fde-6da899c1be43 · outbound

This paper cites Llava-next: Improved reasoning, ocr, and world knowledge,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Llava-next: Improved reasoning, ocr, and world knowledge,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.294391Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.628107Z digest=sha256:ea0c0c631bba975eadd7c9cecad5172982f536cde7ad13b76c35115352226251

Observation e7b32306-7704-48cd-88ed-b73935baf886 · outbound

This paper cites Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-11T23:02:08.635946Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T23:02:08.635946Z digest=sha256:984bc74cb43d97767ee040c40f514fd930f281f733f23101fabd387eb2e7d5e4

Observation aaf78da4-ec95-42d3-9c27-3e524196cf1a · outbound

This paper cites Idefics2: A powerful 8b vision- language model for the community,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Idefics2: A powerful 8b vision- language model for the community,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.272189Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.642905Z digest=sha256:132944d97e96a564861f0e3dbafa2b88b4728aa2ee5a6c6b63eec3c18d6dd52a

Observation 46fe7637-b405-4871-ad78-73a57c9e7ccd · outbound

This paper cites Improved Baselines with Visual Instruction Tuning.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Improved Baselines with Visual Instruction Tuning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-11T23:02:08.654766Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T23:02:08.654766Z digest=sha256:9b1146058c319835646381a2636d77ca1b2db64d1ea3592c970648f5f2eaa5b0

Observation c7e11345-9e82-4e3e-91d7-4dd47aca73b0 · outbound

This paper cites Cloud vision api,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Cloud vision api,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.226975Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.661282Z digest=sha256:35f7a07608e43d58fd815a7547a123d5c7981a7c29016b6cc42e9a383c010a31

Observation e84c9d11-b718-4820-955f-b1670f077902 · outbound

This paper cites A Baseline for Detecting Misclassified and Out-of-Distribution Examples in Neural Networks.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty A Baseline for Detecting Misclassified and Out-of-Distribution Examples in Neural Networks

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-11T23:02:08.674689Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T23:02:08.674689Z digest=sha256:b118cdf0ebfd544314a6b77076f45fdbaab0422befeb0ffb89bcf7098b8b5a80

Observation 6ca13125-a440-4eb9-bc87-2a96e8275c65 · outbound

This paper cites INSIDE: LLMs' Internal States Retain the Power of Hallucination Detection.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty INSIDE: LLMs' Internal States Retain the Power of Hallucination Detection

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-11T23:02:08.680923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T23:02:08.680923Z digest=sha256:924769e2cf4a22abcba57ae652f571ee3aae1225c5a1dde47962f63b2fd8b7c3

Observation 959029d9-1050-4b27-aae1-7d4e00eb54df · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty LLaMA: Open and Efficient Foundation Language Models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-11T23:02:08.687735Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T23:02:08.687735Z digest=sha256:12224fa14988e0f61ca5623c88d762f066021e95bb08a2238c37cc7aa8fdcce8

Observation 3a2a03a6-c124-48e7-b113-15b07fb66920 · outbound

This paper cites Unlocking solutions: In- novative approaches to identifying and mitigating the environmental impacts of undocumented orphan wells in the united states,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Unlocking solutions: In- novative approaches to identifying and mitigating the environmental impacts of undocumented orphan wells in the united states,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.203504Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.693652Z digest=sha256:a6530707a7dc97558ed5118a9704f31776184e04b8c928678f049448beadbe1d

Observation 50e06b5c-8edb-42fd-b93d-906521836ff7 · outbound

This paper cites Chatgpt-4o,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Chatgpt-4o,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.181086Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.699042Z digest=sha256:10fd78df172a4d01505a7c76fdcf49a24461cd945c6ee1d6eb2ae4a9eb37d57b

Observation 67f6812d-8981-4b2e-ac1e-7bf52599e7ba · outbound

This paper cites Corporate reports online,.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Corporate reports online,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.155927Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.705732Z digest=sha256:19ca4cb5625fb2efc52c825994a0b5bc3c6647d60d886390d823a59a6ae24b72

Observation 92bbee0c-089a-45fb-9517-f22544d1938c · outbound

This paper cites Available: https://huggingface.co/ HuggingFaceM4/idefics2-8b 3.

Patchfinder: Leveraging Visual Language Models for Accurate Information Retrieval using Model Uncertainty Available: https://huggingface.co/ HuggingFaceM4/idefics2-8b 3

Reference 2024

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T23:02:09.246232Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T23:02:08.648714Z digest=sha256:84be6b8069b99a13a9e9d4c0eec102edddd955678f19fbb9c0c3d7d584233d9b

Pith citing papers

No inbound Pith citation observations are available.