{"as_of":"2026-08-08T23:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cc4500e086844106fa8252f609df048323f4fa49cc59d8cf73a3a6a2fa238a6b","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:42:51.976807Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01792/citation-record","integrity":"/paper/2608.01792/integrity","json":"/paper/2608.01792/citation-record.json","paper":"/paper/2608.01792"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:52.516206Z","title":null,"venue":null,"work_id":"fb50152e-64d1-4cef-a527-741596a7f795","year":2024},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.837701Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:d47ea8ffd7e9f46dfc0988dda2710c67aa20e22e986e3693ddbc607af2beff8c","observation_id":"51a02e41-7d56-4193-9ac4-3d4d63df422f","resolution":{"observed_at":"2026-08-04T20:42:52.521213Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:51.843885Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.843885Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:c3a18c32467de0064ae6be43daf4d3de76990c9ecea60412eab897b9d992e943","observation_id":"506521c0-f985-46a1-96a2-fbdefb1045ee","resolution":{"observed_at":"2026-08-04T20:42:51.843885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:51.848578Z","title":null,"venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.848578Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:2715f4428033f7ae7f61bca68dc6101eeb4e00f875e969573653b6c8e6d80cf6","observation_id":"523a4a94-8bce-4029-ad33-760392a9b281","resolution":{"observed_at":"2026-08-04T20:42:51.848578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:52.498568Z","title":null,"venue":null,"work_id":"7b372ed2-4630-4ed3-830e-dd856a236f8e","year":1992},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.853485Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:fc82144b68b9b26ab1a2ab43b25bfecea869532ff5ba0332f22de6a9d17490b0","observation_id":"f50648a3-0ad6-49cf-b25e-9adc2bf89f55","resolution":{"observed_at":"2026-08-04T20:42:52.503785Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-41682-8_24","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Lecture notes in computer science","work_id":"9c3b6a0a-dd28-4efa-8209-df19428261e6","year":2023},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.858149Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:e69b779c7a3c3556d3eef3ee5218b3b0d17b9c50926d47d6569d7aca89a94268","observation_id":"50316ac8-78aa-44b9-8415-220167943720","resolution":{"observed_at":"2026-08-04T20:42:52.158724Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:52.482080Z","title":null,"venue":null,"work_id":"d0f83b08-4642-43a2-a21a-76bc08851202","year":2017},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.862695Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:72aa99c3e68e8b18388c22f8976e66b3ccdbf68fc49ffab65ffbb1bccb25ab1d","observation_id":"a8f705ec-141c-482e-8d3a-6b05f2c5dfb8","resolution":{"observed_at":"2026-08-04T20:42:52.486821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:51.867777Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.867777Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:f70a00dd60acb04f737f0b6ade93b19681c01414d2472f092d2b245d78558a52","observation_id":"f054b5bd-6aae-41f2-9e8b-ecc61967f537","resolution":{"observed_at":"2026-08-04T20:42:51.867777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.15958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:52.406966Z","title":null,"venue":null,"work_id":"f2a47120-9c75-4c33-9f7f-4865b39bc073","year":2026},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.873021Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:c150b2bd7d0f568b0ab552103f582074cddc7f7d37804cfd8d5d23b7fa86b435","observation_id":"827c123a-2226-4344-bb07-cb68c87ab350","resolution":{"observed_at":"2026-08-04T20:42:52.415114Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.07038","last_updated":"2026-04-24T04:43:19Z","snapshot_observed_at":"2026-08-08T04:20:37.457117Z","submitted_at":"2026-02-03T12:04:56Z","title":"UNIKIE-BENCH: Benchmarking Large Multimodal Models for Key Information Extraction in Visual Documents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.07038","snapshot_observed_at":"2026-08-04T20:42:51.877602Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.877602Z"},"links":{"cited_paper":"/paper/2602.07038","citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:2a988c323085247b405f9f6c5873a0bccc2c7352f4891762029e692facde78c6","observation_id":"b25ae75a-27bf-4168-b264-919e6e5ae8b8","resolution":{"observed_at":"2026-08-04T20:42:51.877602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v37i12.26742","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"921e0569-c104-4631-aa8b-af91149d4acc","year":2023},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.882749Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:772c4c6e3d7393af0f1b50b31efc8f94ba7c242ee89ccc99eda2787821dc42e1","observation_id":"ef0f6d7e-2342-429f-b670-671ae7e6f891","resolution":{"observed_at":"2026-08-04T20:42:52.142772Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:51.887094Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.887094Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:2f12ee612471ef449b7041ee42b99ac3cab0b27fa6f735c9f76b20ebdbac5f28","observation_id":"55d637ba-87dd-49e6-8f86-8c2fe0e07ab1","resolution":{"observed_at":"2026-08-04T20:42:51.887094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/icdar.2013.248","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"4bd70c31-4dcb-4b47-b214-fa5504946071","year":2013},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.891528Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:a69d6a5e19d581eb0c73df637e6f3fdf3b6b13ee6b06ecdff65ae871fff9564c","observation_id":"d285d374-f417-4f38-915d-6c6565dfcd2d","resolution":{"observed_at":"2026-08-04T20:42:52.114203Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:51.895945Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.895945Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:c4b664894ded0864ae7a8541d52f041f51a6580ffeb6c00e32855538b5da0be4","observation_id":"5d1cbea4-f3bb-4e7a-a575-09f70b4dfe5a","resolution":{"observed_at":"2026-08-04T20:42:51.895945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.compmedimag.2004.09.015","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Computerized Medical Imaging and Graphics","work_id":"6d7ffe65-2316-443d-8b20-80305f3f9217","year":2005},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.900520Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:8c09a5b4206645b552a10be90b4a9a39eea7f74bd304ecd02b41fc77342dceb8","observation_id":"f3a1e755-0338-470c-b893-04146e6148c1","resolution":{"observed_at":"2026-08-04T20:42:52.085019Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00290","last_updated":"2025-05-09T05:37:54Z","snapshot_observed_at":"2026-07-06T20:29:26.524162Z","submitted_at":"2025-02-01T03:18:02Z","title":"Estimating LLM Uncertainty with Evidence","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00290","snapshot_observed_at":"2026-08-04T20:42:51.904889Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.904889Z"},"links":{"cited_paper":"/paper/2502.00290","citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:ad70c07a13e66070e427ca696f8a4226b386444f56a221a0185331d90e055134","observation_id":"bf4e81a8-8231-4cb9-83e4-18991d76f930","resolution":{"observed_at":"2026-08-04T20:42:51.904889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.14445/22312803/ijctt-v71i10p110","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"International Journal of Computer Trends and Technology","work_id":"0b06a10c-0dd3-470e-8152-34c66ec49ac6","year":2023},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.909527Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:91bf2ab98220a2485e627aa37e9eddf08dee9f4199c3ffe5a374b1d9af7f56d7","observation_id":"a575ba16-96a2-4c01-be60-e2d082172469","resolution":{"observed_at":"2026-08-04T20:42:52.067763Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8100.35638","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:52.346718Z","title":null,"venue":null,"work_id":"8e25e005-a3ab-4997-aef2-2c9d2bdb50cf","year":2022},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.914024Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:73f91c47a694fbbbad44bbebb44f749ea5412e95a8659542f4b31fecbe5c63be","observation_id":"c25502f4-6180-4f18-9d88-d42aa71dfef8","resolution":{"observed_at":"2026-08-04T20:42:52.354095Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:51.918344Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.918344Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:948124eed81b3f7af2f27ed6187fa03423d19c15227f86b5e8dc3315e77aaddc","observation_id":"3735739a-5ad2-47b5-9524-6bce0097dc51","resolution":{"observed_at":"2026-08-04T20:42:51.918344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-981-96-1710-4_10","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Lecture notes in computer science","work_id":"13da264f-a212-49a8-83e6-de05f190e9fe","year":2025},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.922561Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:8744ddde02c6e8ccc22ee0afe410c77ef8ad090999c1aeb11d0bdb30618f2fce","observation_id":"4a52cf2e-6483-4cc5-808b-f21117cafe0f","resolution":{"observed_at":"2026-08-04T20:42:52.039127Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:51.927936Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.927936Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:b9ee580f426cbae1bf629883ec32ffd7de46ef87cf4c57d18df56096251ee2b6","observation_id":"48b46573-4fef-4ce8-8221-35ec707562c7","resolution":{"observed_at":"2026-08-04T20:42:51.927936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:52.463931Z","title":null,"venue":null,"work_id":"fccb81e4-3efb-4c46-b143-cc30d34cf90c","year":2024},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.932051Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:ec590424685b89e0ebfd3df8bcd96a873f5ea73205cbb3e06ef95c1f9b6fae16","observation_id":"a23b3838-fa86-4f0b-99fa-4f0b7ed94b67","resolution":{"observed_at":"2026-08-04T20:42:52.468967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05658","last_updated":"2023-05-03T16:24:58Z","snapshot_observed_at":"2026-07-06T14:50:44.713808Z","submitted_at":"2023-02-11T11:32:10Z","title":"DocILE Benchmark for Document Information Localization and Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05658","snapshot_observed_at":"2026-08-04T20:42:51.936311Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.936311Z"},"links":{"cited_paper":"/paper/2302.05658","citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:1e5244f3e22d8335a3556e2b0913c2ed2887ce2b775ba59911268e6ab81c7270","observation_id":"181bc623-7cb8-447f-8b88-f80a26865ffb","resolution":{"observed_at":"2026-08-04T20:42:51.936311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:51.941225Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.941225Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:85236f2f25ef3fb3f8f405036c42b4f9aa8a73ef301737d2d0e60c17bac164ae","observation_id":"61dbcf08-ea36-4fd8-be10-b17faafebe4f","resolution":{"observed_at":"2026-08-04T20:42:51.941225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2403.20101","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:52.287956Z","title":null,"venue":null,"work_id":"337d5ed3-cb14-4667-bade-accc866acd0f","year":2024},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.946558Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:9aec9b9a2f07a69f6354686114db7e7e02436ef6b07ed55a6725d40d4c62f3b2","observation_id":"fa48ad92-412e-41b6-9631-f41062bfa517","resolution":{"observed_at":"2026-08-04T20:42:52.295495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07417","last_updated":"2024-06-14T11:40:31Z","snapshot_observed_at":"2026-07-06T17:28:43.842260Z","submitted_at":"2024-02-12T05:44:10Z","title":"An Empirical Study Into What Matters for Calibrating Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2402.07417","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.07417","snapshot_observed_at":"2026-08-04T20:42:52.262773Z","title":"An Empirical Study Into What Matters for Calibrating Vision-Language Models","venue":"cs.CV","work_id":"b395e6f7-102d-4bc5-8b83-db0368174bfd","year":2024},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.951663Z"},"links":{"cited_paper":"/paper/2402.07417","citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:fd99695c3ee43c7eb1b7f039afdfca083b0da743d5d99ff555294680cf0daf23","observation_id":"c55fc64a-3b37-4880-890b-b3492bf25e95","resolution":{"observed_at":"2026-08-04T20:42:52.269773Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:51.957050Z","title":"Chen, Yoonho Lee, Eric Mitchell, and Chelsea Finn","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.957050Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:8556cfeedc2841d8969629f1b4982ae9bfa5a016d83e258272d6a9a9a6a260c2","observation_id":"4570fa5a-979e-4708-a3d8-413c0bae8ffb","resolution":{"observed_at":"2026-08-04T20:42:51.957050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12767","last_updated":"2024-12-17T10:31:21Z","snapshot_observed_at":"2026-08-05T22:52:18.513702Z","submitted_at":"2024-12-17T10:31:21Z","title":"A Survey of Calibration Process for Black-Box LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12767","snapshot_observed_at":"2026-08-04T20:42:51.961770Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.961770Z"},"links":{"cited_paper":"/paper/2412.12767","citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:d30278c0d21e8f51aadad613761423bb2995ebcb1742dd4f6175663182e6e464","observation_id":"ea20bbbc-c0f3-4d6d-9b09-4d913f21f0f0","resolution":{"observed_at":"2026-08-04T20:42:51.961770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:52.445763Z","title":null,"venue":null,"work_id":"ebf6a683-0561-43d1-9462-53c19175a624","year":2024},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.967198Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:ba5420b7d91db51b6a2886226cf3fc245e9e869ead5c23060af5f609c780ad39","observation_id":"4eaa424f-0bde-46ce-b77d-dba3d09c9a74","resolution":{"observed_at":"2026-08-04T20:42:52.450756Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14848","last_updated":"2025-04-21T04:01:22Z","snapshot_observed_at":"2026-08-07T16:00:41.922151Z","submitted_at":"2025-04-21T04:01:22Z","title":"Object-Level Verbalized Confidence Calibration in Vision-Language Models via Semantic Perturbation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14848","snapshot_observed_at":"2026-08-04T20:42:51.971826Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.971826Z"},"links":{"cited_paper":"/paper/2504.14848","citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:5328c44fd0bc14af696a2f13e470ed4c49ef453a8959018512dfdaed8a8fbe77","observation_id":"2728c654-801f-4d06-9088-f67ebe4c6b99","resolution":{"observed_at":"2026-08-04T20:42:51.971826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2007.43770","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:42:52.197841Z","title":null,"venue":null,"work_id":"8ae419e6-6551-4e1b-a845-969ebf49d9a0","year":2007},"citing_paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T20:42:51.976807Z"},"links":{"citing_paper":"/paper/2608.01792"},"observation_digest":"sha256:7e75a99bb9d462caec4120602eb809c9c80969865e3e2e4348c6e8bdf24ed021","observation_id":"695987d5-c352-478f-9b8e-710af125a6c1","resolution":{"observed_at":"2026-08-04T20:42:52.205959Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01792","last_updated":"2026-08-03T07:03:51Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T08:11:11.405987Z","submitted_at":"2026-08-03T07:03:51Z","title":"Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":19,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2608.01792."}