{"as_of":"2026-08-05T07:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eddd6ea01651cec15dc34fc62b7f8df40879cf43f6c9d7db36fb4e55cf2acbf5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":46,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T08:14:36.635360Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T19:28:52.843969Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T20:37:01.617345Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2304.10592"},"observation_digest":"sha256:55ce2da83f98c09a8d1925b11d24b2756e7d88b770b0d4d002cc4282922782bc","observation_id":"697296b5-2ba4-49ac-ac55-941eb97f7095","resolution":{"observed_at":"2026-05-10T20:37:01.921715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2306.14565","last_updated":"2024-03-19T22:53:25Z","snapshot_observed_at":"2026-07-06T15:46:40.281717Z","submitted_at":"2023-06-26T10:26:33Z","title":"Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T17:34:56.836034Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2306.14565"},"observation_digest":"sha256:434fbc1f1945c751fcb811dcbf54072e4274647bc80b4cd0502e892be7b699d4","observation_id":"1a3b89bf-c79a-4ed3-a493-bde664c9b593","resolution":{"observed_at":"2026-05-14T17:34:56.969543Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2309.05922","last_updated":"2023-09-12T02:34:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-12T02:34:06Z","title":"A Survey of Hallucination in Large Foundation Models","version":1},"reference_index":141,"source":"arxiv_source","source_observed_at":"2026-05-16T15:21:00.778049Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2309.05922"},"observation_digest":"sha256:db318d8cee0636387945bc27f7069da3cd7c257e3f8b4b1d83f37d82a634415b","observation_id":"afd2db2e-72be-48d2-9a91-4e7baa3c2bb6","resolution":{"observed_at":"2026-05-16T15:21:00.977622Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T17:58:17.699042Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2309.14525"},"observation_digest":"sha256:e3d803db56562fe9921c8d5f55f34c3857fcf760d5c19ff770f3dd675bc9c4de","observation_id":"6ae1d947-e68b-4808-bfcf-492bbec5c350","resolution":{"observed_at":"2026-05-15T17:58:17.901268Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T07:13:08.867745Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2310.09478"},"observation_digest":"sha256:83d4c917be1fad61e87bf8a511d82a6ce5dc3f5e635dacb910d8da43936f5145","observation_id":"37e9a718-5127-4d20-a870-4188b80be376","resolution":{"observed_at":"2026-05-16T07:13:08.939153Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2311.07397","last_updated":"2024-02-23T07:54:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T15:25:42Z","title":"AMBER: An LLM-free Multi-dimensional Benchmark for MLLMs Hallucination Evaluation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T06:44:30.244832Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2311.07397"},"observation_digest":"sha256:89683d5483d3c018f5fad6941a8d74c4a17182ec02ed7e6d766f07a8b2e1bed6","observation_id":"b2ecb0dd-577a-4dee-a739-ebb90b134473","resolution":{"observed_at":"2026-05-16T06:44:30.280751Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2401.03568","last_updated":"2024-01-25T21:20:27Z","snapshot_observed_at":"2026-07-30T06:39:40.880794Z","submitted_at":"2024-01-07T19:11:18Z","title":"Agent AI: Surveying the Horizons of Multimodal Interaction","version":2},"reference_index":190,"source":"arxiv_source","source_observed_at":"2026-05-18T14:25:58.876978Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2401.03568"},"observation_digest":"sha256:ec94c574fde5fee51539c8c811259f33f504a23718687123bb83a5dcd2f7488b","observation_id":"23a75bd6-065b-46df-bfdc-6a01dc2345b5","resolution":{"observed_at":"2026-05-18T14:25:59.598259Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2402.11411","last_updated":"2024-02-18T00:56:16Z","snapshot_observed_at":"2026-07-06T17:31:41.687799Z","submitted_at":"2024-02-18T00:56:16Z","title":"Aligning Modalities in Vision Large Language Models via Preference Fine-tuning","version":1},"reference_index":170,"source":"arxiv_source","source_observed_at":"2026-05-17T10:58:53.215887Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2402.11411"},"observation_digest":"sha256:1b760d96fee53434c7ba46c9b6962adb28290a6933875e4c39d93d83e9056cd4","observation_id":"912d49ae-3342-4872-9dd3-1ea18b68a802","resolution":{"observed_at":"2026-05-17T10:58:53.453465Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-05T02:45:38.008864Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"reference_index":141,"source":"pdf_text","source_observed_at":"2026-05-11T12:33:32.631346Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2404.18930"},"observation_digest":"sha256:768c97392cf1c53f6621ba50bd404b9778f43268176029b75fa1615d0d3b3b01","observation_id":"464124d0-21a7-4035-89c8-27f12517beba","resolution":{"observed_at":"2026-05-11T12:33:32.953529Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2406.10185","last_updated":"2026-04-27T07:59:24Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:14:22Z","title":"Detecting and Evaluating Medical Hallucinations in Large Vision Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-23T23:55:57.103971Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2406.10185"},"observation_digest":"sha256:54b4a0d996eaea5a6ae32fc48c4dcbc0f51d810b02697117d75d8442e62cf9f9","observation_id":"07f0b878-a985-4302-aeb6-699d9f49acfb","resolution":{"observed_at":"2026-05-23T23:58:39.544638Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-10T21:07:31.387726Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2408.01800"},"observation_digest":"sha256:afa32865d35e410cf3bc39586485460fb178a45a24f6102a1c8ee23604f9c2ca","observation_id":"85efcd41-1440-4f05-bd22-275b9eada7f5","resolution":{"observed_at":"2026-05-10T21:07:31.834351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2411.10442","last_updated":"2025-04-07T09:09:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-15T18:59:27Z","title":"Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-16T09:16:17.150383Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2411.10442"},"observation_digest":"sha256:498ab232dc5ec63364a72df85cd5a8d82851afa4f5f9c883628985c265159e25","observation_id":"5e4db803-7756-4878-9e48-9c4aebfbdc3d","resolution":{"observed_at":"2026-05-16T09:16:17.417120Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2505.21472","last_updated":"2025-08-11T19:24:13Z","snapshot_observed_at":"2026-07-06T21:31:35.572708Z","submitted_at":"2025-05-27T17:45:21Z","title":"Mitigating Hallucination in Large Vision-Language Models via Adaptive Attention Calibration","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T12:48:44.324236Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2505.21472"},"observation_digest":"sha256:b9aeaab7a37379fdac08689a8eab1c59f33b2408ca101c78430ea5b92e160c18","observation_id":"156fd32f-0218-4bac-bc0f-a2a7edf7aef3","resolution":{"observed_at":"2026-05-19T12:52:18.055019Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2506.13130","last_updated":"2026-04-05T18:57:23Z","snapshot_observed_at":"2026-08-01T06:52:29.993140Z","submitted_at":"2025-06-16T06:27:59Z","title":"ZINA: Multimodal Fine-grained Hallucination Detection and Editing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-19T10:07:18.162776Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2506.13130"},"observation_digest":"sha256:563cf015e2211b8565a122c3dd5f9e36800db49e3a045a6a6b1565cf06cfd07b","observation_id":"363de7a5-aaa4-47de-a927-971a141fafda","resolution":{"observed_at":"2026-05-19T10:12:14.611481Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2507.12455","last_updated":"2026-05-22T04:17:50Z","snapshot_observed_at":"2026-08-02T08:13:56.451097Z","submitted_at":"2025-07-16T17:55:43Z","title":"Mitigating Object Hallucinations via Sentence-Level Early Intervention","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-25T08:31:24.173135Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2507.12455"},"observation_digest":"sha256:a972b25d054db1e1dde4a1c17062071a880785fbe8bf519d68d53147e8a64a80","observation_id":"90974ff9-9fd6-4645-9c8f-5fa7cc58ff8c","resolution":{"observed_at":"2026-05-25T08:35:32.589805Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-04T08:14:36.635360Z","title":"Anna Rohrbach, Lisa Anne Hendricks, Kaylee Burns, Trevor Darrell, and Kate Saenko","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.22067","last_updated":"2026-05-29T17:43:25Z","snapshot_observed_at":"2026-08-04T08:14:34.838427Z","submitted_at":"2025-10-24T23:04:26Z","title":"Capturing Gaze Shifts for Guidance: Cross-Modal Fusion Enhancement for VLM Hallucination Mitigation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T08:14:36.635360Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2510.22067"},"observation_digest":"sha256:ff65c1546fe91bfc1f30aeb945b78f58099b62ec2804e2997662050afc5b34e1","observation_id":"5ef232f3-ed38-462a-8175-99bae75ff279","resolution":{"observed_at":"2026-08-04T08:14:36.635360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2511.10292","last_updated":"2026-05-19T09:24:10Z","snapshot_observed_at":"2026-08-03T13:28:59.205168Z","submitted_at":"2025-11-13T13:29:38Z","title":"Adaptive Residual-Update Steering for Low-Overhead Hallucination Mitigation in Large Vision Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-21T18:47:28.768554Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2511.10292"},"observation_digest":"sha256:4398d4c8b2d1db5afb55e20a8ba91153a6c8eaa4ec5e59a1bb489085450f1f5b","observation_id":"616a1539-8c60-4420-9c04-635cc96b5333","resolution":{"observed_at":"2026-05-21T18:50:30.057037Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-03T08:15:28.752689Z","title":"Object hallucination in image captioning, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.17717","last_updated":"2026-06-09T20:25:14Z","snapshot_observed_at":"2026-08-03T08:15:07.553014Z","submitted_at":"2026-01-25T06:40:25Z","title":"A Survey on Evaluating Quality and Trustworthiness in LLM-Generated Data","version":3},"reference_index":182,"source":"arxiv_source","source_observed_at":"2026-08-03T08:15:28.752689Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2601.17717"},"observation_digest":"sha256:6b3820b95a0a415b638237db445c9198bd4759bf9a1baba1528ea1b465e494b4","observation_id":"8a5bc30f-73c9-4660-aec1-ded9fe32b0c4","resolution":{"observed_at":"2026-08-03T08:15:28.752689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-03T05:37:28.544825Z","title":"A., Burns, K., Darrell, T., and Saenko, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01740","last_updated":"2026-06-05T17:33:12Z","snapshot_observed_at":"2026-08-04T16:16:46.655895Z","submitted_at":"2026-02-02T07:21:02Z","title":"MACD: Model-Aware Contrastive Decoding via Counterfactual Data","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T05:37:28.544825Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2602.01740"},"observation_digest":"sha256:3aab058a04a0933e4b7ddc3d7876678cea02d46a99a03193d08a965183a4af0e","observation_id":"3aa2dc33-9505-4445-8ea2-77467f9fc032","resolution":{"observed_at":"2026-08-03T05:37:28.544825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2602.03454","last_updated":"2026-05-19T03:18:05Z","snapshot_observed_at":"2026-07-06T22:44:23.981940Z","submitted_at":"2026-02-03T12:21:26Z","title":"Contextualized Visual Personalization in Vision-Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T08:20:22.025379Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2602.03454"},"observation_digest":"sha256:010a0090eac23a2757e9f3c9e1ca0ccb05c049736979bfbdcdba1285d859c608","observation_id":"c6284b07-ff09-4ad0-8f25-c98f71f3226d","resolution":{"observed_at":"2026-05-16T08:20:45.961908Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2602.03454","last_updated":"2026-05-19T03:18:05Z","snapshot_observed_at":"2026-07-06T22:44:23.981940Z","submitted_at":"2026-02-03T12:21:26Z","title":"Contextualized Visual Personalization in Vision-Language Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T14:17:12.540477Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2602.03454"},"observation_digest":"sha256:01fd3352674c0353d6f76008888ea3b8fd8baa7d2f0b07e0a9916bb766c98469","observation_id":"9b9799f1-6fae-4654-98a6-46fb04276da0","resolution":{"observed_at":"2026-05-21T14:20:13.765484Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2602.11824","last_updated":"2026-05-11T06:09:34Z","snapshot_observed_at":"2026-07-06T22:45:39.557598Z","submitted_at":"2026-02-12T11:07:44Z","title":"Revis: Sparse Latent Steering to Mitigate Object Hallucination in Large Vision-Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T05:06:24.973439Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2602.11824"},"observation_digest":"sha256:ca52c25ed6a304db2bca01b9ec9c83d781d96cb466363f6a90e8089e457ffc5f","observation_id":"419e7015-7d4e-42af-b322-6c472d40db17","resolution":{"observed_at":"2026-05-16T05:07:20.503881Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2604.10071","last_updated":"2026-04-11T07:19:17Z","snapshot_observed_at":"2026-07-06T22:58:47.599383Z","submitted_at":"2026-04-11T07:19:17Z","title":"Spotlight and Shadow: Attention-Guided Dual-Anchor Introspective Decoding for MLLM Hallucination Mitigation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-10T17:07:09.330134Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2604.10071"},"observation_digest":"sha256:b0601d946f5839b6587a3b00cec88d752cca5c7a9fcb559e08d35589ee49fc06","observation_id":"96674d73-8402-403a-b229-bcca37873af5","resolution":{"observed_at":"2026-05-11T07:35:57.420240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2604.17982","last_updated":"2026-04-20T09:04:49Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:04:49Z","title":"Mitigating Multimodal Hallucination via Phase-wise Self-reward","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T05:10:45.144421Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2604.17982"},"observation_digest":"sha256:4cf48c5713231c2a959210ed2b9c42a991bd1d9646143611335f9c26b8d43972","observation_id":"059541a9-1080-4e56-82a0-9e0d99d23708","resolution":{"observed_at":"2026-05-10T09:43:49.330311Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2604.20366","last_updated":"2026-04-22T09:02:17Z","snapshot_observed_at":"2026-07-06T23:06:49.210284Z","submitted_at":"2026-04-22T09:02:17Z","title":"Mitigating Hallucinations in Large Vision-Language Models without Performance Degradation","version":1},"reference_index":137,"source":"arxiv_source","source_observed_at":"2026-05-10T00:33:39.960170Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2604.20366"},"observation_digest":"sha256:b6087217cb39925c849175128882684a7438e6465c9e2f6ec3880d5a6d27ce49","observation_id":"e2d14852-df1f-4934-9cc3-b0696f1d6f4a","resolution":{"observed_at":"2026-05-10T00:34:47.764596Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2604.25642","last_updated":"2026-04-28T13:42:27Z","snapshot_observed_at":"2026-07-06T23:11:30.068819Z","submitted_at":"2026-04-28T13:42:27Z","title":"Prefill-Time Intervention for Mitigating Hallucination in Large Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-07T16:50:26.044591Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2604.25642"},"observation_digest":"sha256:45306ae913dccf7b2f3ec523628c0df536862d85df1d8a3a50756f09a972a6ea","observation_id":"5b057bdf-cdab-4fb8-8620-8d6c562a406e","resolution":{"observed_at":"2026-05-11T23:31:16.328906Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2605.00323","last_updated":"2026-05-01T01:03:05Z","snapshot_observed_at":"2026-08-02T17:57:46.804255Z","submitted_at":"2026-05-01T01:03:05Z","title":"Online Self-Calibration Against Hallucination in Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-09T20:20:27.931679Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2605.00323"},"observation_digest":"sha256:daeeaf44cf9aab1ae494bdf9890ff8a063a55c3a9240999d71fe51118bf36f3e","observation_id":"612ce53a-bc2f-4fd5-880f-5cb64366a721","resolution":{"observed_at":"2026-05-11T15:16:10.535343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2605.04641","last_updated":"2026-07-29T07:14:27Z","snapshot_observed_at":"2026-08-02T23:57:54.502941Z","submitted_at":"2026-05-06T08:32:30Z","title":"CAST: Mitigating Object Hallucination in Large Vision-Language Models via Caption-Guided Visual Attention Steering","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-08T18:05:38.705480Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2605.04641"},"observation_digest":"sha256:c56c4f7d88778cabd9dd6bfb973b654dc63c44b56ec14065fc1a7c3e1949c87c","observation_id":"66039d67-07d8-4d17-9015-699d0f2547ff","resolution":{"observed_at":"2026-05-09T06:50:40.149814Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2605.11808","last_updated":"2026-05-12T09:03:19Z","snapshot_observed_at":"2026-07-06T23:23:34.924221Z","submitted_at":"2026-05-12T09:03:19Z","title":"Mitigating Action-Relation Hallucinations in LVLMs via Relation-aware Visual Enhancement","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-13T05:44:05.093926Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2605.11808"},"observation_digest":"sha256:8522fad51e1e5b1e141e5618254bb1159489a8e253a75b17aa136d802367136b","observation_id":"e18c536d-7d25-4f01-8667-7633e712a847","resolution":{"observed_at":"2026-05-13T05:47:21.426404Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2605.15951","last_updated":"2026-05-15T13:41:41Z","snapshot_observed_at":"2026-07-06T23:27:11.118592Z","submitted_at":"2026-05-15T13:41:41Z","title":"From Failure to Feedback: Group Revision Unlocks Hard Cases in Object-Level Grounding","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-20T18:39:11.904941Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2605.15951"},"observation_digest":"sha256:341c8a73d9dd3b56a4fc2cfda571b7df80e3e03cc91ac24023e04ae75b55b6ca","observation_id":"5100c479-7e96-4acd-8b2f-2ff752075241","resolution":{"observed_at":"2026-05-20T18:43:38.836035Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2605.16953","last_updated":"2026-05-25T11:08:16Z","snapshot_observed_at":"2026-07-06T23:28:02.429673Z","submitted_at":"2026-05-16T12:08:22Z","title":"How do Humans Process AI-generated Hallucination Contents: a Neuroimaging Study","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T20:33:17.097346Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2605.16953"},"observation_digest":"sha256:7bf70d94facf070a25386b0530bf17b407de851a0e4b6d365bb08bbee6c08ad5","observation_id":"a2bb9b18-8b74-41c2-b1ca-37b5334da984","resolution":{"observed_at":"2026-05-19T20:37:45.365630Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2605.16953","last_updated":"2026-05-25T11:08:16Z","snapshot_observed_at":"2026-07-06T23:28:02.429673Z","submitted_at":"2026-05-16T12:08:22Z","title":"How do Humans Process AI-generated Hallucination Contents: a Neuroimaging Study","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T19:10:49.286658Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2605.16953"},"observation_digest":"sha256:ef19a69cd4e1cd34beee9bac374d57dde10954f06ede94343215ca1b56bc9c84","observation_id":"0da25dd2-1054-4d29-8227-e8de23cd9ef1","resolution":{"observed_at":"2026-06-30T19:15:00.645349Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2605.20950","last_updated":"2026-05-20T09:37:53Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T09:37:53Z","title":"Focus-then-Context: Subject-Centric Progressive Visual Token Reduction for Vision-Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-21T05:20:55.448430Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2605.20950"},"observation_digest":"sha256:443498cf6c1f32ed5922cf937a04754ac960bf63ca88e61902c0852f2101d54c","observation_id":"82982a83-c4f9-44b2-9b15-8c48268b3765","resolution":{"observed_at":"2026-05-21T05:23:58.590578Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2605.27993","last_updated":"2026-05-27T05:33:06Z","snapshot_observed_at":"2026-08-02T18:16:52.435185Z","submitted_at":"2026-05-27T05:33:06Z","title":"Rethinking Visual Neglect: Steering via Context-Preference for MLLM Hallucination Mitigation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-29T13:29:33.614965Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2605.27993"},"observation_digest":"sha256:c8193c6f97165fa2b0b60e55debf6f222241901bcf374d9456ab7ef1132d5b3a","observation_id":"f2888206-de41-456a-a560-92d399075141","resolution":{"observed_at":"2026-06-29T13:33:28.033520Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2605.30911","last_updated":"2026-05-29T06:47:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T06:47:31Z","title":"What Makes LVLMs Hallucinate Less? Unveiling the Architectural Factors Behind Hallucination Robustness","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T23:21:50.254449Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2605.30911"},"observation_digest":"sha256:2ae0d1de3d1078b717a7dd644a542445d212646de911ba323d949f9d6ff2e0a4","observation_id":"cd130a9f-bfc6-48b2-94b0-9e8c3f14eb6d","resolution":{"observed_at":"2026-06-28T23:22:46.588511Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2606.04434","last_updated":"2026-06-03T04:32:09Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T04:32:09Z","title":"Hyper-ICL: Attention Calibration with Hyperbolic Anchor Distillation for Multimodal In-Context Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T07:23:19.428348Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2606.04434"},"observation_digest":"sha256:dbd6c8c6b9d260b0c99d97713e71d6a565301285cc3f33207007965ff2a1981a","observation_id":"defdc462-4b8c-4e0b-89aa-4fa6c166045d","resolution":{"observed_at":"2026-07-02T06:36:43.897031Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2606.07647","last_updated":"2026-06-02T08:23:28Z","snapshot_observed_at":"2026-07-06T23:47:15.041928Z","submitted_at":"2026-06-02T08:23:28Z","title":"Steer Where It Matters: Token-Level Visual-Sensitivity Steering for LVLMs Hallucination Mitigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:40.055153Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2606.07647"},"observation_digest":"sha256:790573db4ec47973213fc16fbd2da1f8c2449684fac75ba390e010aa3f9092be","observation_id":"0ebce830-91cf-4b04-89b4-9986d799d095","resolution":{"observed_at":"2026-07-02T03:06:29.659703Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2606.11853","last_updated":"2026-06-10T09:30:25Z","snapshot_observed_at":"2026-08-02T20:07:37.622537Z","submitted_at":"2026-06-10T09:30:25Z","title":"Task-Aware Structured Memory for Dynamic Multi-modal In-Context Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-06-27T10:28:11.440915Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2606.11853"},"observation_digest":"sha256:56b010942dc1ac0b226891eb0064b3fc41c5f3fa86a3ac7131d20014f0a08423","observation_id":"c2a7b65c-f690-4133-ac7c-94bd81e40a74","resolution":{"observed_at":"2026-07-03T09:07:48.423984Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2606.17678","last_updated":"2026-06-16T08:45:24Z","snapshot_observed_at":"2026-08-02T21:26:38.863648Z","submitted_at":"2026-06-16T08:45:24Z","title":"See First, Answer Later: Visual Evidence Pre-Alignment via Sufficiency-Driven RL","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T01:44:24.586195Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2606.17678"},"observation_digest":"sha256:e26d2eaa875049316578d41ccd923eaa236c9275f04812509186f6c5991d47cd","observation_id":"ef07b4d4-3c01-40db-b381-f8e96953689e","resolution":{"observed_at":"2026-07-03T19:28:52.845331Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":"1809.02156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-03T19:28:52.843969Z","title":"Object Hallucination in Image Captioning","venue":"cs.CL","work_id":"1027f299-c39b-4061-b0fd-32e237d53dbe","year":2018},"citing_paper":{"arxiv_id":"2606.27596","last_updated":"2026-06-25T22:55:46Z","snapshot_observed_at":"2026-08-02T11:25:40.949648Z","submitted_at":"2026-06-25T22:55:46Z","title":"Dismantling Pathological Shortcuts: A Causal Framework for Faithful LVLM Decoding","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-06-29T01:18:13.657975Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2606.27596"},"observation_digest":"sha256:66a3b927ef39bb78eb29b2e2bb8fd9dc14205f9845b59396f79187c71bc7c1a0","observation_id":"7ad6c26b-1e76-4801-ac32-e683167afc16","resolution":{"observed_at":"2026-07-01T19:06:02.557971Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-12T11:14:52.015620Z","title":"Rohrbach, A.; Hendricks, L","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.28862","last_updated":"2026-07-05T22:18:45Z","snapshot_observed_at":"2026-08-04T19:17:44.996159Z","submitted_at":"2026-06-27T11:10:33Z","title":"HKVLM: Faithful Query--Region Binding for Frozen-Detector Visual Grounding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T11:14:52.015620Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2606.28862"},"observation_digest":"sha256:e1481ab0433a6aa763dd7d3b4f7d9d963975108f6a235f4614af28442dbe19a2","observation_id":"259d4117-c0f9-4fda-88f8-bdf868c4f613","resolution":{"observed_at":"2026-07-12T11:14:52.015620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-02T01:57:58.861159Z","title":"Object hallucination in image captioning.arXiv preprint arXiv:1809.02156, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.14499","last_updated":"2026-07-16T02:25:03Z","snapshot_observed_at":"2026-08-04T11:10:46.858246Z","submitted_at":"2026-07-16T02:25:03Z","title":"Contextualized Evaluation of Vision Language Models through Dynamic, Multi-turn Interactions","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T01:57:58.861159Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2607.14499"},"observation_digest":"sha256:bef57058c33ba113f1c9d8120d267cda72239dcf771f960bcd79db2099377fdb","observation_id":"739c3fa0-0e2e-48cc-8e4a-3b7cbc5ec0b4","resolution":{"observed_at":"2026-08-02T01:57:58.861159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-01T14:44:02.483130Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18673","last_updated":"2026-08-03T23:44:52Z","snapshot_observed_at":"2026-08-05T07:47:49.143257Z","submitted_at":"2026-07-21T03:43:50Z","title":"MissingBench-Verified: Probing Vision-Language Models' Inability to Detect Missing Object Parts","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T14:44:02.483130Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2607.18673"},"observation_digest":"sha256:3196a90e18d6240f378ce2f45cb3766a7500800e296f0401d1d3e87993acc1d6","observation_id":"8af5a2a3-2cf2-4f9f-bd96-cbaae4c706b9","resolution":{"observed_at":"2026-08-01T14:44:02.483130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-01T08:36:00.831745Z","title":"arXiv preprint arXiv:1809.02156 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21076","last_updated":"2026-07-23T09:08:57Z","snapshot_observed_at":"2026-08-03T22:13:46.453188Z","submitted_at":"2026-07-23T09:08:57Z","title":"C-PTQ: Fisher-weighted Channel-wise Sensitivity for Post-training Quantization of MLLMs","version":1},"reference_index":127,"source":"arxiv_source","source_observed_at":"2026-08-01T08:36:00.831745Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2607.21076"},"observation_digest":"sha256:215f861e2b1b2f5b9b2b384ca7180f827711fcaea6052f2709244d416f733ceb","observation_id":"abe41923-8cab-4434-aaa0-91b75873553d","resolution":{"observed_at":"2026-08-01T08:36:00.831745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-01T13:10:37.549654Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.22716","last_updated":"2026-07-21T15:52:30Z","snapshot_observed_at":"2026-08-01T13:10:35.695248Z","submitted_at":"2026-07-21T15:52:30Z","title":"Visual Token Compression Enhances Robustness of MLLMs","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-01T13:10:37.549654Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2607.22716"},"observation_digest":"sha256:b72c89fea64efaacdb03d37fcd9c640de374963ea7096902cb0051b8ee97c0a8","observation_id":"aa46c5ec-2e36-4cc1-badb-8f99e1a0b110","resolution":{"observed_at":"2026-08-01T13:10:37.549654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-07-31T23:19:55.028375Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.24017","last_updated":"2026-07-27T05:30:19Z","snapshot_observed_at":"2026-08-03T09:11:16.165986Z","submitted_at":"2026-07-27T05:30:19Z","title":"Disentangling Semantic Attention from Structural Bias in the Attention Manifold","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T23:19:55.028375Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2607.24017"},"observation_digest":"sha256:6d84c72b56e12308ea6d2debfbcf6fc0b9d939e7385d42150f99da14309f39cd","observation_id":"ed379f1e-006a-4fda-887b-faef1b2908b6","resolution":{"observed_at":"2026-07-31T23:19:55.028375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1809.02156/citation-record","integrity":"/paper/1809.02156/integrity","json":"/paper/1809.02156/citation-record.json","paper":"/paper/1809.02156"},"outbound":[],"paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 46 inbound Pith citation observations for arXiv:1809.02156."}