{"as_of":"2026-08-19T09:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:175292183f5128b34bb5adfe2bfc51b8fc25f3222afd025c7b7fb0ef7a5121c5","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:54:19.613972Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.03788/citation-record","integrity":"/paper/2505.03788/integrity","json":"/paper/2505.03788/citation-record.json","paper":"/paper/2505.03788"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1904.02794","last_updated":"2019-04-11T19:59:37Z","snapshot_observed_at":"2026-08-18T06:26:59.039019Z","submitted_at":"2019-04-04T21:12:37Z","title":"VQD: Visual Query Detection in Natural Scenes","version":2},"cited_work":{"arxiv_id":"1904.02794","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.02794","snapshot_observed_at":"2026-08-16T04:54:19.990998Z","title":"VQD: Visual Query Detection in Natural Scenes","venue":"cs.CV","work_id":"b2a6fbc0-1b52-49c4-94dc-80e242122700","year":2019},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.476383Z"},"links":{"cited_paper":"/paper/1904.02794","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:6a7d3fcf752cc8aaf2f6814e80eff972aa473a25e4be7a8a9e6b2b06a1360736","observation_id":"f106cfc3-b819-4af6-af64-c11baf4ed319","resolution":{"observed_at":"2026-08-16T04:54:19.995191Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08433","last_updated":"2023-10-12T15:56:24Z","snapshot_observed_at":"2026-08-16T14:52:39.111753Z","submitted_at":"2023-10-12T15:56:24Z","title":"A Confederacy of Models: a Comprehensive Evaluation of LLMs on Creative Writing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08433","snapshot_observed_at":"2026-08-16T04:54:19.503477Z","title":"A confederacy of models: A comprehensive evaluation of llms on creative writing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.503477Z"},"links":{"cited_paper":"/paper/2310.08433","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:bbab3960333e1dbe7c8211ec7093087609e218b6e9954042442f7c33ba609954","observation_id":"53d7e6cc-7bdc-4f73-9b7d-05b76929ab4f","resolution":{"observed_at":"2026-08-16T04:54:19.503477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02917","last_updated":"2024-05-05T12:51:38Z","snapshot_observed_at":"2026-08-16T13:55:18.261813Z","submitted_at":"2024-05-05T12:51:38Z","title":"Overconfidence is Key: Verbalized Uncertainty Evaluation in Large Language and Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02917","snapshot_observed_at":"2026-08-16T04:54:19.511692Z","title":"Overconfidence is key: Verbalized uncertainty evaluation in large language and vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.511692Z"},"links":{"cited_paper":"/paper/2405.02917","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:f2a0a4b32124a275d139de92e06a2115382cefdf84f49b696ce6bb617173cdc5","observation_id":"528858d6-e646-40af-aa2d-851d24f2d46f","resolution":{"observed_at":"2026-08-16T04:54:19.511692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-08-16T13:36:21.119762Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-16T04:54:19.515277Z","title":"Deberta: Decoding-enhanced bert with disentangled attention","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.515277Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:7a51d37397ae66f166c0cde7c3dee1f2be168ffe74f10700c592f064a8692add","observation_id":"7d986630-f109-4611-ab01-d4dad73997ea","resolution":{"observed_at":"2026-08-16T04:54:19.515277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-16T04:54:19.519231Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.519231Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:914f5d6848596e30a99567f64f373f956962165d8ab015cd7a5db23f702e08ca","observation_id":"a7369a8e-c3f8-462f-9775-2e96ae9140ba","resolution":{"observed_at":"2026-08-16T04:54:19.519231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.03551","last_updated":"2017-05-13T21:12:37Z","snapshot_observed_at":"2026-08-13T08:58:47.096400Z","submitted_at":"2017-05-09T21:35:07Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.03551","snapshot_observed_at":"2026-08-16T04:54:19.531484Z","title":"Triviaqa: A large scale distantly supervised challenge dataset for reading comprehension","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.531484Z"},"links":{"cited_paper":"/paper/1705.03551","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:2814b5f46298dcc808eb912f1a14f2453bc03f6660c9ac2ce56cc3efe477f754","observation_id":"7791a210-2eb7-4b48-9bc5-d29c874b9e13","resolution":{"observed_at":"2026-08-16T04:54:19.531484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-16T04:54:19.535260Z","title":"Language models (mostly) know what they know","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.535260Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:28e1ce90d6f3bde3c1eb7fafb9537c1d8e13802545b251e54df1c23312a52f0c","observation_id":"1a2ed9a4-8718-42b1-8f1c-92b4be223a2b","resolution":{"observed_at":"2026-08-16T04:54:19.535260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14418","last_updated":"2024-02-24T12:30:40Z","snapshot_observed_at":"2026-08-16T14:16:18.299665Z","submitted_at":"2024-02-22T10:04:17Z","title":"Uncertainty-Aware Evaluation for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14418","snapshot_observed_at":"2026-08-16T04:54:19.542896Z","title":"Uncertainty-aware evaluation for vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.542896Z"},"links":{"cited_paper":"/paper/2402.14418","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:4887085b4e7be7eeae0ecd3df5599e9fd08984514cd0cc53607e5b24b6229966","observation_id":"2a47baca-48bd-4ff6-b2c7-bced60e43cbc","resolution":{"observed_at":"2026-08-16T04:54:19.542896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09664","last_updated":"2023-04-15T12:55:45Z","snapshot_observed_at":"2026-07-06T14:53:27.667483Z","submitted_at":"2023-02-19T20:10:07Z","title":"Semantic Uncertainty: Linguistic Invariances for Uncertainty Estimation in Natural Language Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09664","snapshot_observed_at":"2026-08-16T04:54:19.546731Z","title":"Semantic uncertainty: Linguistic invariances for uncertainty estimation in natural language generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.546731Z"},"links":{"cited_paper":"/paper/2302.09664","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:58c1e6a3d4e1dead5f0129119fb31e443e7a1b8f27187c57948ed9f80792e293","observation_id":"29909f85-0646-46b3-92da-cef124afc3d8","resolution":{"observed_at":"2026-08-16T04:54:19.546731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00890","last_updated":"2023-06-01T16:50:07Z","snapshot_observed_at":"2026-08-09T05:23:28.778360Z","submitted_at":"2023-06-01T16:50:07Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00890","snapshot_observed_at":"2026-08-16T04:54:19.550795Z","title":"Llava-med: Training a large language-and-vision assistant for biomedicine in one day","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.550795Z"},"links":{"cited_paper":"/paper/2306.00890","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:d5b0afd50600016b36aa98155f814f9a5cdad1f5288d5495ce2bf50a869d1e3f","observation_id":"8bd506f9-05b4-4273-b90b-7d7cbb7fc6a2","resolution":{"observed_at":"2026-08-16T04:54:19.550795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:54:20.028237Z","title":"Slake: A semantically- labeled knowledge-enhanced dataset for medical visual question answering","venue":null,"work_id":"0c8fbd9c-ad67-4f83-8d92-bbe511f2dc62","year":2021},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.558629Z"},"links":{"citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:e5435087baf5285a5ac7515a93f02761fa1fb8855036fff555a7c64beec10570","observation_id":"71cb0814-b590-4b44-a6c2-ec3922f90705","resolution":{"observed_at":"2026-08-16T04:54:20.032176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-16T04:54:19.566442Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.566442Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:bf464d745d297a343a5162ef116f4ca27e0338207224dd98fdb6d0dba1b26963","observation_id":"3f3a41b2-4a8a-4cf1-a2d4-157447258a67","resolution":{"observed_at":"2026-08-16T04:54:19.566442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02352","last_updated":"2024-10-29T01:09:44Z","snapshot_observed_at":"2026-08-16T13:37:42.360949Z","submitted_at":"2024-07-02T15:17:44Z","title":"Pelican: Correcting Hallucination in Vision-LLMs via Claim Decomposition and Program of Thought Verification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02352","snapshot_observed_at":"2026-08-16T04:54:19.570695Z","title":"Pelican: Correcting hallucination in vision-llms via claim decomposition and program of thought verification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.570695Z"},"links":{"cited_paper":"/paper/2407.02352","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:1c511926b7316e06b7cf7cd3d39bf98e13647e26ce2f341cf2194cbf3915dd45","observation_id":"638672cf-8d23-4acb-8333-8d2a41af96bf","resolution":{"observed_at":"2026-08-16T04:54:19.570695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05563","last_updated":"2025-07-01T22:08:39Z","snapshot_observed_at":"2026-08-16T14:41:18.143042Z","submitted_at":"2024-12-07T06:56:01Z","title":"A Survey on Uncertainty Quantification of Large Language Models: Taxonomy, Open Research Challenges, and Future Directions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05563","snapshot_observed_at":"2026-08-16T04:54:19.575021Z","title":"A survey on uncertainty quantification of large language models: Taxonomy, open research challenges, and future directions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.575021Z"},"links":{"cited_paper":"/paper/2412.05563","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:e7a4dadf63713aee49d006c83869aa9be61311b180db5d6f0f01e2d1d5936945","observation_id":"51c01721-af72-4fab-947e-c88201bc642a","resolution":{"observed_at":"2026-08-16T04:54:19.575021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:54:20.015736Z","title":"Just ask for calibration: Strategies for eliciting calibrated confidence scores from language models fine-tuned with human feedback","venue":null,"work_id":"bdd0fdfe-87df-490c-8746-a93279555a7d","year":2023},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.578972Z"},"links":{"citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:29b3a8bc06b7899b90bfe0ae726128e73f06ccad9e5d9f603768d44a7f65510a","observation_id":"cac051d6-62b7-483d-b6cb-f32efad5cfd1","resolution":{"observed_at":"2026-08-16T04:54:20.020196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-16T04:54:19.583631Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.583631Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:ba59be3c3c250d2842c46866dd72746ea5b89ae598166f91d8ca2ba52860d9b6","observation_id":"d7b9fc1e-b139-4d0d-b2d9-c9771d613f93","resolution":{"observed_at":"2026-08-16T04:54:19.583631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-16T04:54:19.588230Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.588230Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:5e3c90c62f9b1bd03afeb50705a502d4dab8c54f27aedf1b9593412f5e7d3cc4","observation_id":"f82b17f6-5445-4319-8d61-3e5b7b7ee5c3","resolution":{"observed_at":"2026-08-16T04:54:19.588230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12601","last_updated":"2025-04-08T02:39:57Z","snapshot_observed_at":"2026-07-06T20:38:25.164930Z","submitted_at":"2025-02-18T07:25:12Z","title":"COPU: Conformal Prediction for Uncertainty Quantification in Natural Language Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12601","snapshot_observed_at":"2026-08-16T04:54:19.593315Z","title":"Copu: Conformal prediction for uncertainty quantification in natural language generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.593315Z"},"links":{"cited_paper":"/paper/2502.12601","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:9b4de9ac94eb27aae84098752ac3436453e68b17a865155bc1e096973eb01301","observation_id":"3b18bc8a-730c-4733-be3f-46de5b383a73","resolution":{"observed_at":"2026-08-16T04:54:19.593315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12794","last_updated":"2024-10-31T16:58:51Z","snapshot_observed_at":"2026-08-16T14:25:11.494628Z","submitted_at":"2024-01-23T14:29:17Z","title":"Benchmarking LLMs via Uncertainty Quantification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12794","snapshot_observed_at":"2026-08-16T04:54:19.601232Z","title":"Benchmarking llms via uncertainty quantification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.601232Z"},"links":{"cited_paper":"/paper/2401.12794","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:7bd894b6b0020ed77568557ca19024159138bc27377879392e7beac59095da59","observation_id":"17d5fe97-a88f-4836-a1f3-21295eb71081","resolution":{"observed_at":"2026-08-16T04:54:19.601232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00915","last_updated":"2025-01-08T22:58:51Z","snapshot_observed_at":"2026-08-18T14:56:57.492279Z","submitted_at":"2023-03-02T02:20:04Z","title":"BiomedCLIP: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00915","snapshot_observed_at":"2026-08-16T04:54:19.609432Z","title":"Biomedclip: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.609432Z"},"links":{"cited_paper":"/paper/2303.00915","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:93aa0eb61b363fcb873d6af45d73942b0fbc13e84b7aeb1fa9e4015f3adaec78","observation_id":"c0cde35f-4ca5-41ba-a5a8-911a5e0c6d3c","resolution":{"observed_at":"2026-08-16T04:54:19.609432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:54:20.003564Z","title":"Distribution Statement “A” (Approved for Public Release, Distribution Unlimited)","venue":null,"work_id":"7bf6ea05-9b72-4456-a0c2-0349ed8858b2","year":1904},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.613972Z"},"links":{"citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:a341fe198a177259d3991bbee540fbfde64d40629e5c92ed4b023523b8a453d6","observation_id":"b358de03-1109-43a6-8241-d12fe5e8937a","resolution":{"observed_at":"2026-08-16T04:54:20.008092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-16T04:54:19.523675Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":1957,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.523675Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:a05a87ab83e714984c18bf0e583648b4cf60b5d3a640ff0de24ff081a96e93bd","observation_id":"32cc1297-6605-44c2-848d-53dda7029126","resolution":{"observed_at":"2026-08-16T04:54:19.523675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-16T04:54:19.494769Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":1983,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.494769Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:ec9eb18d1ddd8f50c7d83db5098f4790010ea44d4b72c1b9e511a67c2ad736a4","observation_id":"692e433c-3f85-4f85-aae9-54704f0f2517","resolution":{"observed_at":"2026-08-16T04:54:19.494769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19187","last_updated":"2024-05-20T01:53:36Z","snapshot_observed_at":"2026-08-18T09:28:29.473363Z","submitted_at":"2023-05-30T16:31:26Z","title":"Generating with Confidence: Uncertainty Quantification for Black-box Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19187","snapshot_observed_at":"2026-08-16T04:54:19.554640Z","title":"Generating with confidence: Uncertainty quantifica- tion for black-box large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.554640Z"},"links":{"cited_paper":"/paper/2305.19187","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:88c5801747ecf1dbbe137efd48096adbb876c49d47716612b20bcca67537a240","observation_id":"df4fe64c-34cf-4d44-bc53-2f24566d212f","resolution":{"observed_at":"2026-08-16T04:54:19.554640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19930","last_updated":"2025-08-27T15:21:58Z","snapshot_observed_at":"2026-08-16T14:04:42.156678Z","submitted_at":"2024-11-29T18:42:28Z","title":"On Domain-Adaptive Post-Training for Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19930","snapshot_observed_at":"2026-08-16T04:54:19.486637Z","title":"On domain-specific post-training for multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.486637Z"},"links":{"cited_paper":"/paper/2411.19930","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:d54d60243d3b1a86b29d2098f00495878315c9a5912993290be3c6b3de3c7b84","observation_id":"cafcb103-ce07-40fa-a1de-bc41e1b5a059","resolution":{"observed_at":"2026-08-16T04:54:19.486637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10193","last_updated":"2024-06-01T21:40:33Z","snapshot_observed_at":"2026-08-16T15:23:12.630691Z","submitted_at":"2023-06-16T21:55:08Z","title":"Conformal Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10193","snapshot_observed_at":"2026-08-16T04:54:19.562429Z","title":"Conformal language modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.562429Z"},"links":{"cited_paper":"/paper/2306.10193","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:54b3396dad5dd2da4184b11a6fe15d7215b93c5bb7ddc75f2a28c82e4b99b239","observation_id":"d07cf3de-7c63-405a-aa0a-66cfdf7a456d","resolution":{"observed_at":"2026-08-16T04:54:19.562429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T04:54:19.507486Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.507486Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:2ab183d3427007772690fb28e4435d967e4807f3b47758fa64595ef2c958cdf3","observation_id":"594b804e-8065-447c-bece-24fc9fe9d047","resolution":{"observed_at":"2026-08-16T04:54:19.507486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11919","last_updated":"2024-11-28T13:35:56Z","snapshot_observed_at":"2026-08-16T19:08:16.706246Z","submitted_at":"2024-11-18T04:06:04Z","title":"VL-Uncertainty: Detecting Hallucination in Large Vision-Language Model via Uncertainty Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11919","snapshot_observed_at":"2026-08-16T04:54:19.605281Z","title":"Vl-uncertainty: Detecting hallucination in large vision-language model via uncertainty estimation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.605281Z"},"links":{"cited_paper":"/paper/2411.11919","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:85290c710b067a70c38cb7002f588640f803968db091b42934b87387051787d8","observation_id":"e93b0ff0-392b-4232-a1bb-64d78e2c2c84","resolution":{"observed_at":"2026-08-16T04:54:19.605281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T04:54:19.481765Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.481765Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:965c2609348b589410ac0ce509070aa41f7ab3910537beb7a5f4e158f71cb518","observation_id":"4abc8c8f-6f97-486d-ac07-1cb83fbc2002","resolution":{"observed_at":"2026-08-16T04:54:19.481765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14612","last_updated":"2024-05-28T11:18:20Z","snapshot_observed_at":"2026-08-16T13:50:10.893128Z","submitted_at":"2024-05-23T14:24:23Z","title":"Explaining Multi-modal Large Language Models by Analyzing their Vision Perception","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14612","snapshot_observed_at":"2026-08-16T04:54:19.499010Z","title":"Explaining multi-modal large language models by analyzing their vision perception","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.499010Z"},"links":{"cited_paper":"/paper/2405.14612","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:b4aa7e46cc1952cd74a3d3c570ac55d1f9ca42b5d9de3e95a9e6270387e72c7b","observation_id":"98f50b02-9378-4573-9b5b-31142428528c","resolution":{"observed_at":"2026-08-16T04:54:19.499010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:54:20.040350Z","title":"Ad- dressing uncertainty in llms to enhance reliability in generative ai","venue":null,"work_id":"f5cc5bf5-8c3f-446d-b2e6-91c8e80f9a08","year":2024},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.539111Z"},"links":{"citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:f3f239a2911260169831c2e8e0ae618e72966b5bdce8fb1499fd7d2decf311fa","observation_id":"32ec6484-02e9-4d69-8de1-1209c021b0fc","resolution":{"observed_at":"2026-08-16T04:54:20.044723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07002","last_updated":"2025-05-13T14:13:13Z","snapshot_observed_at":"2026-08-16T13:11:02.912755Z","submitted_at":"2024-10-09T15:45:52Z","title":"CursorCore: Assist Programming through Aligning Anything","version":3},"cited_work":{"arxiv_id":"2410.07002","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.07002","snapshot_observed_at":"2026-08-16T04:54:19.857310Z","title":"CursorCore: Assist Programming through Aligning Anything","venue":"cs.CL","work_id":"9ad22a4b-b17b-4ca9-8d79-581090d2d8da","year":2024},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.527763Z"},"links":{"cited_paper":"/paper/2410.07002","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:2c6b1fe1d7e89399cc044997b3eea96a0c6b7712d081f7c54dc930144cb7b01b","observation_id":"3b910364-32d7-4efa-8944-546d2bfa3e16","resolution":{"observed_at":"2026-08-16T04:54:19.864090Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:54:20.052963Z","title":"An empirical study of in-context learning in llms for machine translation","venue":null,"work_id":"95001036-a5aa-4113-8fa7-fe76d4f731a2","year":2024},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.490997Z"},"links":{"citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:e6f49f113fe4576f0b9f275bd55ff26169ecc0e61d7ec48af0ce4a14fb81dc8b","observation_id":"f93fe253-2eaf-422f-b3b9-3b892a1b1d04","resolution":{"observed_at":"2026-08-16T04:54:20.058355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-16T04:54:19.597151Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.597151Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:4462d2263b255c36416f2a9a7d597b82ff6b430bf03a5683a4215d1aae308c20","observation_id":"08139543-4f96-4fb7-97f1-2b8cc04c518d","resolution":{"observed_at":"2026-08-16T04:54:19.597151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T17:49:24.508878Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":2,"verified_fuzzy":5},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2505.03788."}