{"as_of":"2026-08-08T17:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:edc315bb87ceffe860835cd1d7558ef38987a13b35a65285c925d0e1572725f0","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:41:00.935085Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24007/citation-record","integrity":"/paper/2505.24007/integrity","json":"/paper/2505.24007/citation-record.json","paper":"/paper/2505.24007"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.16673","last_updated":"2023-11-28T10:39:19Z","snapshot_observed_at":"2026-07-06T16:53:43.840652Z","submitted_at":"2023-11-28T10:39:19Z","title":"Large Language Models Meet Computer Vision: A Brief Survey","version":1},"cited_work":{"arxiv_id":"2311.16673","doi":"10.48550/arxiv.2311.16673","metadata_source":"pith","pith_arxiv_id":"2311.16673","snapshot_observed_at":"2026-08-07T18:16:16.850658Z","title":"Large Language Models Meet Computer Vision: A Brief Survey","venue":"cs.CV","work_id":"e6c81c1e-6eed-49db-b50d-9cdf93aa644f","year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.220585Z"},"links":{"cited_paper":"/paper/2311.16673","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:98cfcad774e046b8029a48227daf1f91a421c14cef78501d61a6593438bfe890","observation_id":"a5846db8-7a21-478d-bd71-0d8ea749fda5","resolution":{"observed_at":"2026-08-07T12:41:02.793428Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:56.294964Z","title":"Neural Computing and Applications 37(4), 1973–1997 (2025) https://doi.org/10.1007/s00521-024-10827-6","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.294964Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:0851e75b33c916a969af1df25dc359fd4ba1e8ab7445d6cc21043a17dbc96be4","observation_id":"251261e7-b271-4c35-bb4b-469ee052b063","resolution":{"observed_at":"2026-08-07T12:40:56.294964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:56.356073Z","title":"In: 2024 27th International Conference on Computer and Information Technology (ICCIT), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.356073Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:bd24a30eea92767b53d5ac3c0ba5824d3fb9feb6e832cf49c2b53675dd055c62","observation_id":"6ac390b1-69d9-40b1-928f-22f61521a3cc","resolution":{"observed_at":"2026-08-07T12:40:56.356073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:04.415198Z","title":"Neural Computing and Applications (2025) https://doi.org/10.1007/ s00521-024-10495-6","venue":null,"work_id":"2cbd8f08-640a-45fb-9a18-f513ea7c78b2","year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.430347Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:67386ec617b91488c962540a4cf4a04d8bf3a8cc4ee4721e310ac7a98f3a3921","observation_id":"243c1c26-057b-4dd5-ae2a-9cb1d7b616e1","resolution":{"observed_at":"2026-08-07T12:41:04.534859Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.banglalp-1.10","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:02.489233Z","title":"In: Proceedings of the First Workshop on Bangla Language Processing (BLP-2023), pp","venue":null,"work_id":"58b8de02-ef5e-4548-afaf-ac6f57d5c75c","year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.492816Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:f16ef52124c1cc43346e17cc9d29265a4dc32ff2adb3f14c81f08919b78341d7","observation_id":"3ace651d-25bc-42b4-a803-321a022b1c85","resolution":{"observed_at":"2026-08-07T12:41:02.594651Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10007","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:03.668967Z","title":"Natural Language Processing Journal 7, 100079 (2024) https: //doi.org/10.1016/j.nlp.2024.100079","venue":null,"work_id":"5ec5650d-3711-47b1-9e47-1a4de7b7a854","year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.576538Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:93f7b2447de43fbabebef5b35a900c60fce5ba07e618014cd52f0ad86d717507","observation_id":"7a670189-2eb5-4f15-a4fb-0d891c7faa57","resolution":{"observed_at":"2026-08-07T12:41:03.771280Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:04.187950Z","title":"In: Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing, pp","venue":null,"work_id":"431075ce-25d7-4ef7-937e-83a5330d027d","year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.658006Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:60d400c52e8b957224af5088ecf6e340c0d9390d7ed2cd68ad49df32e0a656d1","observation_id":"7512a4f4-d9a1-4cc2-ab47-0299bb71815f","resolution":{"observed_at":"2026-08-07T12:41:04.279671Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:56.736341Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence 46(8), 5625–5644 (2024) https://doi.org/10.1109/TPAMI.2024.3369699 18","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.736341Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:19c820826d042b6ed1a225f389477fce207d9f4966bbf7ab7308eda8d9377539","observation_id":"8f68a974-2e4a-4bc9-991d-c025d913b1af","resolution":{"observed_at":"2026-08-07T12:40:56.736341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:56.867713Z","title":"In: 2024 IEEE Canadian Conference on Electrical and Computer Engineering (CCECE), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.867713Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:bdc3e25efcc473e0e3d33c2dbac840bee9c5114fefa25650a95b8e48535685e5","observation_id":"02b3278f-bb94-47fb-9f7e-a5f0c175563f","resolution":{"observed_at":"2026-08-07T12:40:56.867713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00521-024-10310-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:02.317094Z","title":"Neural Computing and Applications 36(33), 20849–20861 (2024) https://doi.org/10.1007/s00521-024-10310-2","venue":null,"work_id":"c39957e3-bd80-4dba-b38e-0c72f1c0fe4a","year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.006197Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:6ca86bb6570b6a2698f3c329902665d35c997b5bbf93e5191ecc53761261a836","observation_id":"c693f11c-ba13-4b5e-8fbb-38ed28f9d3d5","resolution":{"observed_at":"2026-08-07T12:41:02.379643Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:57.134997Z","title":"ACM Transactions on Information Systems 43(2), 1–55 (2025) https://doi.org/10.1145/3703155","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.134997Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:1bb2b60648383a2efec1199826a5cfd5ae2939cde9eb0c5a7b8c4530ab157195","observation_id":"964e48c8-3227-402e-9bf1-404735c696fa","resolution":{"observed_at":"2026-08-07T12:40:57.134997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02189","last_updated":"2025-04-06T03:12:51Z","snapshot_observed_at":"2026-07-06T20:16:27.318761Z","submitted_at":"2025-01-04T04:59:33Z","title":"A Survey of State of the Art Large Vision Language Models: Alignment, Benchmark, Evaluations and Challenges","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02189","snapshot_observed_at":"2026-08-07T12:40:57.268736Z","title":"arXiv preprint arXiv:2501.02189 1 (2025) https://doi.org/10.48550/arXiv.2501.02189","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.268736Z"},"links":{"cited_paper":"/paper/2501.02189","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:4438b1fb1822cd2f762dcfd0a61064f205924ba1a4bf186fe07cb2556d44fccd","observation_id":"3660bffe-a860-46d9-8b63-2f13919212e5","resolution":{"observed_at":"2026-08-07T12:40:57.268736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11817","last_updated":"2025-02-13T08:11:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-22T10:26:14Z","title":"Hallucination is Inevitable: An Innate Limitation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11817","snapshot_observed_at":"2026-08-07T12:40:57.368955Z","title":"https://doi.org/10.48550/arXiv.2401","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.368955Z"},"links":{"cited_paper":"/paper/2401.11817","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:58aa9666af548d9a1020df2a4221b921185f7055dbc697dd2ecd4983ea1b4fb2","observation_id":"6763a4c0-e56b-4ab5-a684-6fba44ac812f","resolution":{"observed_at":"2026-08-07T12:40:57.368955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:03.993904Z","title":"https://cdn.openai.com/papers/ GPTV System Card.pdf","venue":null,"work_id":"dd664915-ffce-4ca4-94f8-1848fe8e37e8","year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.447252Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:e94462fd601bee2e4dca681dc5771283e750cfe8f08d836e688feded16fb14da","observation_id":"d52194f0-3366-4b28-8c97-dafd754a9aa1","resolution":{"observed_at":"2026-08-07T12:41:04.124117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T12:40:57.592968Z","title":"arXiv preprint arXiv:2304.10592 (2023) https://doi.org/10.48550/arXiv.2304.10592","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.592968Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:a5e08635ee81f64e4d965cb36670bed3f1f3bf1bd9e696cf1cbe4136f67b8538","observation_id":"a3fb02c4-1287-4b5d-a734-4c7c3bfe0f13","resolution":{"observed_at":"2026-08-07T12:40:57.592968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-08-07T12:40:57.776021Z","title":"arXiv preprint arXiv:2402.14683 (2024) https://doi.org/ 10.48550/arXiv.2402.14683","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.776021Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:a8d1b69122c72bde5f3e9760aef5e05bc86e8c1d3fcd9383d901f6edc73f9efd","observation_id":"862b44a8-62ee-49d1-b434-f352787d9f27","resolution":{"observed_at":"2026-08-07T12:40:57.776021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00521-025-11229-y","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:01.959504Z","title":"Neural Computing and Applications (2025) https: //doi.org/10.1007/s00521-025-11229-y","venue":null,"work_id":"071fa31a-db8a-4a33-a90a-93978fac5759","year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.911112Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:79fdd05074f3affc229e18192cd2e4d7b8bfa6fe259af4e3b71bb2ab2931bb54","observation_id":"359af40f-55f2-4189-a8e5-adc2f19f4a93","resolution":{"observed_at":"2026-08-07T12:41:02.031620Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20331","last_updated":"2025-06-09T11:51:00Z","snapshot_observed_at":"2026-07-06T17:53:11.000124Z","submitted_at":"2024-03-29T17:59:53Z","title":"Unsolvable Problem Detection: Robust Understanding Evaluation for Large Multimodal Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20331","snapshot_observed_at":"2026-08-07T12:40:58.104064Z","title":"arXiv e-prints, 2403 (2024) https://doi.org/10.48550/arXiv","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.104064Z"},"links":{"cited_paper":"/paper/2403.20331","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:608821b08b4be415f72d4c1c9859a0fd42bc771f44c74728d5559cd34f53595c","observation_id":"eeefadf2-cac0-4f77-877e-2bbe79f734ec","resolution":{"observed_at":"2026-08-07T12:40:58.104064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00521-024-10895-8","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:01.761785Z","title":"Neural Computing and 19 Applications (2025) https://doi.org/10.1007/s00521-024-10895-8","venue":null,"work_id":"5d108091-b22b-4112-ab89-6ba0da1ff060","year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.253626Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:a24fc66ca319120c94b4914ddb007b79f00c7325aa428885ded210eb325874ae","observation_id":"1425827c-cdfc-46a2-b052-c93e6219074f","resolution":{"observed_at":"2026-08-07T12:41:01.833515Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10185","last_updated":"2026-04-27T07:59:24Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:14:22Z","title":"Detecting and Evaluating Medical Hallucinations in Large Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10185","snapshot_observed_at":"2026-08-07T12:40:58.390282Z","title":"https://doi.org/10.48550/arXiv.2406.10185","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.390282Z"},"links":{"cited_paper":"/paper/2406.10185","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:72ac1482397ae52e65d198b637aa54c1aefa37cce823032c16e51de745c068cb","observation_id":"e945f82f-3692-4d0f-a26f-b062d481658e","resolution":{"observed_at":"2026-08-07T12:40:58.390282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-07T12:40:58.547958Z","title":"arXiv preprint arXiv:2404.18930 (2024) https://doi.org/10.13140/RG.2.2.27797.13280","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.547958Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:610f430ee064fb34e1a45bd73c9ce4e875b2705bba6930146312c8cacb9907c5","observation_id":"0d48a18e-b26f-466c-814c-9f41d170f2c0","resolution":{"observed_at":"2026-08-07T12:40:58.547958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01920","last_updated":"2024-06-04T03:04:21Z","snapshot_observed_at":"2026-08-06T20:49:37.611347Z","submitted_at":"2024-06-04T03:04:21Z","title":"CODE: Contrasting Self-generated Description to Combat Hallucination in Large Multi-modal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01920","snapshot_observed_at":"2026-08-07T12:40:58.682028Z","title":"Advances in Neural Information Processing Systems 37, 133571–133599 (2024) https://doi.org/10","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.682028Z"},"links":{"cited_paper":"/paper/2406.01920","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:1e44c522aa89546ec33b8b0e1a4ef6e66a5031124478418a6132f26d7b55ea8e","observation_id":"58875b92-2d6f-4d65-b8d5-82a3ba694024","resolution":{"observed_at":"2026-08-07T12:40:58.682028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-07T12:40:58.836392Z","title":"arXiv preprint arXiv:2305.10355 (2023) https://doi.org/10.48550/arXiv.2305.10355","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.836392Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:ee6e0e0eb5fcdb5e8057f56ba67a48167975898ac7cc99168c393e8baaed3ffb","observation_id":"41bcaaba-f3ba-46d8-bec9-fbdd8b83738d","resolution":{"observed_at":"2026-08-07T12:40:58.836392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T12:40:58.909680Z","title":"arXiv preprint arXiv:2304.08485 (2023) https://doi.org/10.48550/arXiv.2304.08485","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.909680Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:9e567337f58240f9cdc24ee42fbec7c4b5f5dbfdcb9ef45647e43ce11481f09a","observation_id":"6872bd60-f2e8-4c26-8daf-3792654f3b93","resolution":{"observed_at":"2026-08-07T12:40:58.909680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10900","last_updated":"2024-10-09T03:42:22Z","snapshot_observed_at":"2026-08-08T04:34:36.202690Z","submitted_at":"2024-06-16T11:44:43Z","title":"AutoHallusion: Automatic Generation of Hallucination Benchmarks for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10900","snapshot_observed_at":"2026-08-07T12:40:58.968730Z","title":": Autohallusion: Automatic genera- tion of hallucination benchmarks for vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.968730Z"},"links":{"cited_paper":"/paper/2406.10900","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:3a1c2fb10bdee55db10cf9b8f144d6ab021711aa8fe8a18faadcbeac53ff8ad5","observation_id":"ad7278ce-b8e9-4fc0-b928-a74fcfd77ee9","resolution":{"observed_at":"2026-08-07T12:40:58.968730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:59.057403Z","title":"https://doi.org/10.1109/CVPR52733.2024.01230","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.057403Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:af9fc331b004870325be1b2d980c8501fba8dc06062ab0671f9bd3c20152f5cc","observation_id":"3e796555-5004-4122-aed7-ad1797ff95bf","resolution":{"observed_at":"2026-08-07T12:40:59.057403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-07T12:40:59.118464Z","title":"arXiv preprint arXiv:1809.02156 (2018) https: //doi.org/10.48550/arXiv.1809.02156","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.118464Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:3b9f847b5fa0bd259eedbbdfb16497d6897296d722b20a6a5b5da45f377f9df2","observation_id":"2af4382f-70d7-45af-a622-cb1375061370","resolution":{"observed_at":"2026-08-07T12:40:59.118464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T12:40:59.202797Z","title":"arXiv preprint arXiv:2304.08485 (2023) https://doi.org/10.48550/arXiv.2306.14565","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.202797Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:546426878270fa5d6e1b0719f35eeed3577c1bd3e1f90202734aac2405fd1302","observation_id":"a74ec7fb-aaca-4dbd-9efa-2e0eb2d096e4","resolution":{"observed_at":"2026-08-07T12:40:59.202797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T12:40:59.276089Z","title":"arXiv preprint arXiv:2304.10592 (2023) https: //doi.org/10.48550/arXiv.2312.06968","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.276089Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:8c4da61ddf76e6ef893a735ec59ef5eaab2218b503a464538a068a87f9a5ebac","observation_id":"525724e9-67f9-4f45-b474-b64e6b4a0775","resolution":{"observed_at":"2026-08-07T12:40:59.276089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-07T12:40:59.350199Z","title":": Aligning large multimodal models with factually aug- mented rlhf","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.350199Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:834058ee169a90603319e2aa16f5fb888e0851b0bd09c3fae6e5229309c3f041","observation_id":"008afc84-f0ff-4cd3-9b62-13d7aa902acf","resolution":{"observed_at":"2026-08-07T12:40:59.350199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14401","last_updated":"2024-09-01T07:45:02Z","snapshot_observed_at":"2026-08-08T00:07:01.985401Z","submitted_at":"2024-03-21T13:49:42Z","title":"Pensieve: Retrospect-then-Compare Mitigates Visual Hallucination","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14401","snapshot_observed_at":"2026-08-07T12:40:59.418262Z","title":"arXiv preprint arXiv:2403.14401 (2024) https://doi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.418262Z"},"links":{"cited_paper":"/paper/2403.14401","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:53a037348b3f1659a83d7e32eee00695f5dea6d18758fffcc0a56ef8810240c9","observation_id":"f974fdf9-da18-43a7-9d6f-e7adfad9b256","resolution":{"observed_at":"2026-08-07T12:40:59.418262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T12:40:59.497050Z","title":"arXiv preprint arXiv:2304.08485 (2023) https://doi.org/10.48550/arXiv.2311.07362","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.497050Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:e120e59ce4916210b2b22f7396db0e8d7adcd679337a4adc590e3ff4c4337c3a","observation_id":"4dcbec0e-33a8-4869-bbab-1419a0e70079","resolution":{"observed_at":"2026-08-07T12:40:59.497050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T12:40:59.657207Z","title":"arXiv preprint arXiv:2304.10592 (2023) https://doi.org/10.48550/arXiv.2412.15650","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.657207Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:693469ee6894fd6d97a4ef5966ae599c411575f75f5e28be44d65d4e22539bb4","observation_id":"5dc94f1a-9b52-4f35-995b-4e5a42951b2a","resolution":{"observed_at":"2026-08-07T12:40:59.657207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T12:40:59.884885Z","title":"arXiv preprint arXiv:2304.10592 (2023) https://doi.org/10.48550/arXiv.2310","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.884885Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:424e55246f8a44431848280d4f00ba608abbd18b4c696eadce40ef34bdbebb6c","observation_id":"c4f3f71a-54bc-4b65-acef-f8bb1c8e0041","resolution":{"observed_at":"2026-08-07T12:40:59.884885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T12:41:00.011918Z","title":"arXiv preprint arXiv:2304.10592 (2023) https://doi.org/10.48550/arXiv","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.011918Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:f94c7299ee726366624063202890a9b709df6ff0f7378b4ac56de610b4e0d145","observation_id":"8898939a-b9f7-47d9-8342-ad36587b6e31","resolution":{"observed_at":"2026-08-07T12:41:00.011918Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-07T12:41:00.088984Z","title":"arXiv preprint arXiv:2304.14178 (2023) https://doi.org/10.48550/ arXiv.2304.14178","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.088984Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:c2ccc4c79c06bcc690165ae9236324bdf4953590f8750a9101b928c023334ecb","observation_id":"e7ba7add-402f-46b0-8973-0a7fd14a29a9","resolution":{"observed_at":"2026-08-07T12:41:00.088984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2503.10602","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:01.270082Z","title":"arXiv preprint arXiv:2503.10602 (2025) https: //doi.org/10.48550/arXiv.2503.10602","venue":null,"work_id":"7ce61e18-575b-45c1-979d-60b2f5d50bf0","year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.146778Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:6cd0d0748010bde26cab468eba880d441aaaa82e7e75ecb21c4508c2e71d1365","observation_id":"473c8ee1-3e15-4275-b381-996af429d938","resolution":{"observed_at":"2026-08-07T12:41:01.373295Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-07T12:41:00.211781Z","title":"21 In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.211781Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:9c854663dd0c5d01502cea23ac2bc2ca57d522813447a4440b053860d78eaf38","observation_id":"8a9d247e-884c-4bea-a11f-76a279545091","resolution":{"observed_at":"2026-08-07T12:41:00.211781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08896","last_updated":"2023-10-11T17:43:28Z","snapshot_observed_at":"2026-07-06T15:03:55.982628Z","submitted_at":"2023-03-15T19:31:21Z","title":"SelfCheckGPT: Zero-Resource Black-Box Hallucination Detection for Generative Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08896","snapshot_observed_at":"2026-08-07T12:41:00.303458Z","title":"https: //doi.org/10.48550/arXiv.2303.08896","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.303458Z"},"links":{"cited_paper":"/paper/2303.08896","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:951e4383084986432f9672373006600323415fd55c89d34a16fa4d2f9cdbf635","observation_id":"b19066f8-044c-4b14-90ad-ee316cc24946","resolution":{"observed_at":"2026-08-07T12:41:00.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15680","last_updated":"2024-07-22T14:49:51Z","snapshot_observed_at":"2026-08-04T17:31:28.745659Z","submitted_at":"2024-07-22T14:49:51Z","title":"HaloQuest: A Visual Hallucination Dataset for Advancing Multimodal Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15680","snapshot_observed_at":"2026-08-07T12:41:00.398895Z","title":"In: European Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.398895Z"},"links":{"cited_paper":"/paper/2407.15680","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:dd28d5c2f858b24cbcf05a056b7b7ce0d317b363c741c739cf88c77f961b0fa3","observation_id":"a6ce1d0e-33e8-4244-97ba-91b9add0c013","resolution":{"observed_at":"2026-08-07T12:41:00.398895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:00.521223Z","title":"Acoustics, Speech and Signal Processing, IEEE Transactions on 27, 13–18 (1979) https: //doi.org/10.1109/TASSP.1979.1163188","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.521223Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:2bf1f38accf26a8b77d41e35bec2da40a0208b2664b7786bb8c531d20ba91c6b","observation_id":"c7a1c40a-a0c8-4e8b-b8a4-1fbc8161ccff","resolution":{"observed_at":"2026-08-07T12:41:00.521223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"dp/0133356","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:02.993404Z","title":"Prentice- Hall, Inc., USA (2006)","venue":null,"work_id":"45951362-3412-4b19-b6b6-450d451f3c9c","year":2006},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.643213Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:f0d2e453b753006821e732e18e01da569a51011344142203f3dc5713669fc9d3","observation_id":"cc214bc1-4142-46e3-bd3b-a1c6675b8943","resolution":{"observed_at":"2026-08-07T12:41:03.083893Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:00.733910Z","title":"In: Jurafsky, D., Chai, J., Schluter, N., Tetreault, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.733910Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:5455530185c99b7281150a1b12ddc455b04cc09c42c86cf5ff2f1904306dabcd","observation_id":"3a133b97-3d01-4a6d-af50-7926e5aee6da","resolution":{"observed_at":"2026-08-07T12:41:00.733910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:00.823710Z","title":"In: Walker, M., Ji, H., Stent, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.823710Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:0f76079a8ba88241dcb3c525eae143f50349d6e4d6c70228dcfee79cb238148f","observation_id":"0d36e74e-88dc-4ae6-88ce-daef072ff68a","resolution":{"observed_at":"2026-08-07T12:41:00.823710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-07T12:41:00.935085Z","title":"In: The Eleventh International Conference on Learning Representations (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.935085Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:840c4090be6364bd389a2a5e27882f3d0a3f8320d2586aca2ca74f2c796fde34","observation_id":"76158028-c7d8-4caf-a3c0-1f8050e03bf0","resolution":{"observed_at":"2026-08-07T12:41:00.935085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":3,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":33,"verified_exact":7,"verified_fuzzy":1},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2505.24007."}