{"as_of":"2026-08-10T06:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fe105ba574f65fac6da45e6b2c70916a00301d9ae9067d1da702e43a654c9bb3","coverage":[{"denominator":11,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:44:12.467523Z","state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.00371/citation-record","integrity":"/paper/2509.00371/integrity","json":"/paper/2509.00371/citation-record.json","paper":"/paper/2509.00371"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-05T13:44:11.128418Z","title":"Qwen-vl: A versatile vision-language model for un- derstanding, localization, text reading, and beyond","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","snapshot_observed_at":"2026-08-08T21:19:51.024363Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:44:11.128418Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2509.00371"},"observation_digest":"sha256:f2dd3dd7592b04f591f43b70a415f6018aad123b221c79ee5c74bb4a2cd052d7","observation_id":"917bc445-abec-4a32-a802-d4c53b192504","resolution":{"observed_at":"2026-08-05T13:44:11.128418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-05T13:44:11.756372Z","title":"Blip- 2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","snapshot_observed_at":"2026-08-08T21:19:51.024363Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:44:11.756372Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2509.00371"},"observation_digest":"sha256:cf8b0a167ab55b1d3f166f74b808ea57236adda21a1324aa23d64a0f01c1f1dd","observation_id":"9981d8e9-977f-4a11-9e1d-f1cab6db9ada","resolution":{"observed_at":"2026-08-05T13:44:11.756372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15839","last_updated":"2025-03-15T12:22:18Z","snapshot_observed_at":"2026-07-06T19:56:08.504922Z","submitted_at":"2024-11-24T13:42:02Z","title":"VaLiD: Mitigating the Hallucination of Large Vision Language Models by Visual Layer Fusion Contrastive Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15839","snapshot_observed_at":"2026-08-05T13:44:12.219337Z","title":"Valid: Mitigat- ing the hallucination of large vision language models by visual layer fusion contrastive decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","snapshot_observed_at":"2026-08-08T21:19:51.024363Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:44:12.219337Z"},"links":{"cited_paper":"/paper/2411.15839","citing_paper":"/paper/2509.00371"},"observation_digest":"sha256:41d83b1bfb36facde4bad4d074cb736fcd219284e4297ae9187faffed7ee7edd","observation_id":"8ed0382d-e4fe-4882-8e73-e2a81bd260af","resolution":{"observed_at":"2026-08-05T13:44:12.219337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-05T13:44:12.346730Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","snapshot_observed_at":"2026-08-08T21:19:51.024363Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:44:12.346730Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2509.00371"},"observation_digest":"sha256:81243af4e9e8ee760e269d166655c1f08abd15c9e1b41eba13c9b1800472a7f9","observation_id":"b3174e35-cabf-40c9-92ba-e91e6ca197a3","resolution":{"observed_at":"2026-08-05T13:44:12.346730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:44:12.670117Z","title":"Is there a chair in the image?","venue":null,"work_id":"d56b27f7-9bb5-482f-a62d-b00b31d8b11b","year":2023},"citing_paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","snapshot_observed_at":"2026-08-08T21:19:51.024363Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:44:12.467523Z"},"links":{"citing_paper":"/paper/2509.00371"},"observation_digest":"sha256:d3e8e3e41fc48e2b583427912df652af3ee087563b00e061a10b5f1920303671","observation_id":"7fad797e-553b-4dcf-89a3-6458c09561a9","resolution":{"observed_at":"2026-08-05T13:44:12.786808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T13:44:12.068411Z","title":"doi: 10.18653/v1/D18-1437","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","snapshot_observed_at":"2026-08-08T21:19:51.024363Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-05T13:44:12.068411Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2509.00371"},"observation_digest":"sha256:c40b795712cda10df426cabd28e6d37d98341c80e1c6036449cdb1555348786d","observation_id":"369f9e92-24ef-4677-bb07-05a940c405f8","resolution":{"observed_at":"2026-08-05T13:44:12.068411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:44:12.925176Z","title":"Object hallucination in image captioning","venue":null,"work_id":"ab2165ad-f8fa-4f89-8eed-5677331537e3","year":2018},"citing_paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","snapshot_observed_at":"2026-08-08T21:19:51.024363Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T13:44:11.927719Z"},"links":{"citing_paper":"/paper/2509.00371"},"observation_digest":"sha256:06bc0d256a5ec76a057b5546c39d79910d0c18904ddd6d5c6e336ca62d5ab3e1","observation_id":"33a1702d-ad89-4941-acc0-92abf86ef147","resolution":{"observed_at":"2026-08-05T13:44:13.053871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00425","last_updated":"2024-06-10T15:21:41Z","snapshot_observed_at":"2026-08-07T09:16:51.378562Z","submitted_at":"2024-03-01T10:21:52Z","title":"HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00425","snapshot_observed_at":"2026-08-05T13:44:11.340003Z","title":"Halc: Object hallucination reduc- tion via adaptive focal-contrast decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","snapshot_observed_at":"2026-08-08T21:19:51.024363Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T13:44:11.340003Z"},"links":{"cited_paper":"/paper/2403.00425","citing_paper":"/paper/2509.00371"},"observation_digest":"sha256:117d56d353255e847c740edb2fbdd00dcc8a53e719c8c5ed52d9949b7576047a","observation_id":"33479d02-de5f-42d6-bd19-2581909c9f02","resolution":{"observed_at":"2026-08-05T13:44:11.340003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T13:44:11.202844Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","snapshot_observed_at":"2026-08-08T21:19:51.024363Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T13:44:11.202844Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2509.00371"},"observation_digest":"sha256:b4dee670bc29aef9a793f74cfc2545e0a3ace7bf426a1cb64f5876ea2e545cd7","observation_id":"d6239db5-d241-4e32-b4db-0f8ff4549ecf","resolution":{"observed_at":"2026-08-05T13:44:11.202844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-05T13:44:11.450936Z","title":"Mme: A comprehensive evaluation bench- mark for multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","snapshot_observed_at":"2026-08-08T21:19:51.024363Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T13:44:11.450936Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2509.00371"},"observation_digest":"sha256:a235e977c3554d6b308ac9b9d303c4ae4a7eb205290789ff7f4cd144ada4c697","observation_id":"c350eef3-4f04-414c-8c49-35496891718c","resolution":{"observed_at":"2026-08-05T13:44:11.450936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02032","last_updated":"2025-03-16T06:51:13Z","snapshot_observed_at":"2026-08-06T05:55:18.425562Z","submitted_at":"2024-08-04T13:50:17Z","title":"Self-Introspective Decoding: Alleviating Hallucinations for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02032","snapshot_observed_at":"2026-08-05T13:44:11.659686Z","title":"org/abs/2408.02032","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","snapshot_observed_at":"2026-08-08T21:19:51.024363Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T13:44:11.659686Z"},"links":{"cited_paper":"/paper/2408.02032","citing_paper":"/paper/2509.00371"},"observation_digest":"sha256:b83a62a574b944f2df2d48acb67412d529b3695fb5f30762772cc4d75d718585","observation_id":"60028cfd-02f4-4f97-a9bf-e950da4e781b","resolution":{"observed_at":"2026-08-05T13:44:11.659686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T21:19:51.024363Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs"},"reference_resolution":{"displayed":11,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":11},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 11 of 11 outbound references and 0 inbound Pith citation observations for arXiv:2509.00371."}