{"as_of":"2026-08-11T08:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:237d868938090f6aae0b72eb33860827991430ecdda7db4c0ede194a848c4d14","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T10:47:44.075469Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07302/citation-record","integrity":"/paper/2608.07302/integrity","json":"/paper/2608.07302/citation-record.json","paper":"/paper/2608.07302"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.891133Z","title":"Flamingo: a visual language model for few-shot learning.Advances in neural information processing systems, 35:23716–23736,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.891133Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:1edc1eacb9f449dc5747e86dd23842c03454c653c567b6156b37f8f3fe8da292","observation_id":"0e320b62-8865-4ece-abad-63999b4708fd","resolution":{"observed_at":"2026-08-10T10:47:43.891133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.837523Z","title":"Mitigating object hallucinations in large vision- language models with assembly of global and local attention","venue":null,"work_id":"0bdee84c-de8b-4a23-8596-4a68ba32a62f","year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.895940Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:0cce2faf9686dc31102fdb8c9774414ff87f616343f9084f0cf5df21f6f8b38f","observation_id":"99d03d34-605b-4c96-9e6a-54551257cd88","resolution":{"observed_at":"2026-08-10T10:47:44.841598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-10T10:47:43.900405Z","title":"Qwen-vl: A versatile vision-language model for un- derstanding, localization, text reading, and beyond.arXiv preprint arXiv:2308.12966, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.900405Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:ccccc2b81d49505831a457c5b8a9563d5f42d501f788ec2c8852b8c13ec66e8a","observation_id":"f8ba24a2-c3c4-4151-a77a-6592f564fb22","resolution":{"observed_at":"2026-08-10T10:47:43.900405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-10T10:47:43.905091Z","title":"Hallucination of multimodal large language models: A survey.arXiv preprint arXiv:2404.18930, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.905091Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:f647330d74ccaf7ae1f517a3f5bd8e196ee837ec9c327093b2c992038e54cbb9","observation_id":"82a7088a-e450-4fce-9278-68e97ad3d517","resolution":{"observed_at":"2026-08-10T10:47:43.905091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.825951Z","title":"Ict: Image-object cross-level trusted intervention for mitigating object halluci- nation in large vision-language models","venue":null,"work_id":"fba9421d-9420-45e9-a55b-483b4a61ad11","year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.910328Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:12bf16e69a149a7f103892e0bd69ab93cc656174365668ea618bc13afb8a096c","observation_id":"3cf3aa9d-e1d5-484b-9485-2e3fb0831961","resolution":{"observed_at":"2026-08-10T10:47:44.830009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-10T10:47:43.914584Z","title":"Shikra: Unleashing multi- modal llm’s referential dialogue magic.arXiv preprint arXiv:2306.15195, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.914584Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:3f3b6c9dce75272e3d7a17916af72f9e7b75221b66af78402ebd44ba3eb9524f","observation_id":"c151d0e4-ad30-4c36-9fc8-f3cbc4665155","resolution":{"observed_at":"2026-08-10T10:47:43.914584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16479","last_updated":"2023-11-27T09:30:02Z","snapshot_observed_at":"2026-08-09T15:58:21.146758Z","submitted_at":"2023-11-27T09:30:02Z","title":"Mitigating Hallucination in Visual Language Models with Visual Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16479","snapshot_observed_at":"2026-08-10T10:47:43.918681Z","title":"Mitigating hallucination in visual language models with visual supervi- sion.arXiv preprint arXiv:2311.16479, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.918681Z"},"links":{"cited_paper":"/paper/2311.16479","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:68ae14c2ffaf04aa5c43fc00e902e8cce98e323f7421f08fc83371bf6120589d","observation_id":"7000a756-3aa0-4606-9338-7fc8a9f5274b","resolution":{"observed_at":"2026-08-10T10:47:43.918681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.922861Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.922861Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:c850074a4841671c2e63a5041736fb3b6aca3269cc640b9d4f7ae3bfc03b1837","observation_id":"b11a80a3-aaa8-412a-8a3a-176479ab9f85","resolution":{"observed_at":"2026-08-10T10:47:43.922861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00425","last_updated":"2024-06-10T15:21:41Z","snapshot_observed_at":"2026-08-10T17:38:58.073992Z","submitted_at":"2024-03-01T10:21:52Z","title":"HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00425","snapshot_observed_at":"2026-08-10T10:47:43.926644Z","title":"Halc: Object hallucination re- duction via adaptive focal-contrast decoding.arXiv preprint arXiv:2403.00425, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.926644Z"},"links":{"cited_paper":"/paper/2403.00425","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:472f7440808d7819c0053970132ad7e89e3ddb8218dc0263a7507601bb004773","observation_id":"e89ab366-f85c-431a-8c3a-7467c7ac55c2","resolution":{"observed_at":"2026-08-10T10:47:43.926644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.930595Z","title":"Instructblip: Towards general-purpose vision- language models with instruction tuning.Advances in neural information processing systems, 36:49250–49267, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.930595Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:3c9bf402c7c587ac35566ab901aa5fa257cb9d06be675cbf467d869c8fe74e07","observation_id":"d4dde930-0bf6-42af-87fb-bbe478075ca4","resolution":{"observed_at":"2026-08-10T10:47:43.930595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.934722Z","title":"Damro: Dive into the attention mechanism of lvlm to re- duce object hallucination.arXiv preprint arXiv:2410.04514,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.934722Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:a6d2d5b947ece17e161736491c0c93a3388b79a962469b08a39f11273d0b3662","observation_id":"60cb3f27-032c-4303-8ea5-e7a8d8d689d4","resolution":{"observed_at":"2026-08-10T10:47:43.934722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.799652Z","title":"Opera: Alleviating hallucination in multi- modal large language models via over-trust penalty and retrospection-allocation","venue":null,"work_id":"18b45c22-13ab-4c9b-9d61-577e35cf7982","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.938593Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:17770d01f600a13dc071b60a66c43ae45c70b290fc56d3a758954a328ab2a617","observation_id":"86a2d1d9-cf6e-4cc0-962f-6032434cbb14","resolution":{"observed_at":"2026-08-10T10:47:44.803823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.787299Z","title":"Hallucination augmented contrastive learn- ing for multimodal large language model","venue":null,"work_id":"7dca137b-f7b6-4abf-b6b1-382009c9f26d","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.942300Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:fcc36fb86abbeb75c57841dffbc7e5077cb2209c57d0b908a39b693c09a79f9b","observation_id":"00a1ab87-7705-4d79-bfc7-4bf232784739","resolution":{"observed_at":"2026-08-10T10:47:44.791239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02762","last_updated":"2025-02-10T20:13:31Z","snapshot_observed_at":"2026-08-09T16:06:26.088504Z","submitted_at":"2024-10-03T17:59:57Z","title":"Interpreting and Editing Vision-Language Representations to Mitigate Hallucinations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02762","snapshot_observed_at":"2026-08-10T10:47:43.945970Z","title":"Interpreting and editing vision-language rep- resentations to mitigate hallucinations.arXiv preprint arXiv:2410.02762, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.945970Z"},"links":{"cited_paper":"/paper/2410.02762","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:206fa1ebabea5e436c34683d30daee8ff360b3bfd09df691652efadbce50b0c7","observation_id":"615a9787-1c90-4108-8fb9-c20c8e3c0411","resolution":{"observed_at":"2026-08-10T10:47:43.945970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.776144Z","title":"Devils in middle layers of large vision- language models: Interpreting, detecting and mitigating ob- ject hallucinations via attention lens","venue":null,"work_id":"647d9bc0-ddfb-424a-b8c1-86c3470880de","year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.949886Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:1f5f407b2957b00f545a9ac2f4318f6def22c385638703d9754a4ab58b154420","observation_id":"fcda5f3b-5dad-45a7-b2c4-e0e8ca6eed1a","resolution":{"observed_at":"2026-08-10T10:47:44.780119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.763939Z","title":"What’s in the im- age? a deep-dive into the vision of vision language models","venue":null,"work_id":"658bde4b-8b21-4aa4-8eb9-60843da3630c","year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.953525Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:0fc8a2e280959ae509ccdb41f40350f943caf442ae93f4e83b90f92c3a369921","observation_id":"2dfebab3-5a67-4cf4-8e2f-57ef29db632b","resolution":{"observed_at":"2026-08-10T10:47:44.768877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.03321","last_updated":"2025-03-05T09:55:07Z","snapshot_observed_at":"2026-08-10T21:22:18.894347Z","submitted_at":"2025-03-05T09:55:07Z","title":"See What You Are Told: Visual Attention Sink in Large Multimodal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.03321","snapshot_observed_at":"2026-08-10T10:47:43.957166Z","title":"See what you are told: Visual attention sink in large multimodal models.arXiv preprint arXiv:2503.03321, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.957166Z"},"links":{"cited_paper":"/paper/2503.03321","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:885ed2678631c655b1f9396d8c22379f79b649f7dad913aab6cf50b727faee3c","observation_id":"bc3af201-0a87-4966-a990-2f6c2f8c9e5d","resolution":{"observed_at":"2026-08-10T10:47:43.957166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.752389Z","title":"Mitigating object hal- lucinations in large vision-language models through visual contrastive decoding","venue":null,"work_id":"fcf0518e-f9c5-4004-9b9e-df24e669874b","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.960888Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:2ad1d25c9e89b0830003d36c821065de346efb8117a4c9066dd63aa4c41a4169","observation_id":"2deb19e1-8498-4016-99bc-2ff7fe9c96b5","resolution":{"observed_at":"2026-08-10T10:47:44.756687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.964835Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.964835Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:223fa1de286cdbb5c4d832edd278babaa0f012a68290de7059f5c0b326e5e230","observation_id":"dee3fdc5-0835-45d7-971e-9ba4096b2e8a","resolution":{"observed_at":"2026-08-10T10:47:43.964835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.968690Z","title":"Mvbench: A comprehensive multi-modal video understand- ing benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.968690Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:651b3fa49ead46b32938c7179ff137f5d617c459ffe8cf6c577f2f0efc9f266c","observation_id":"5e31a5d3-4f45-4260-a211-e3fe9936d7b9","resolution":{"observed_at":"2026-08-10T10:47:43.968690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.727249Z","title":"Contrastive decoding: Open-ended text genera- tion as optimization","venue":null,"work_id":"1b0d9246-7787-42ae-8e47-401ee96640f7","year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.972351Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:0c305002f99efcd3c0d34ca35e5e06ceb94a87c51a04fbaeabffa6ddf54c4209","observation_id":"c87cbf62-5bc7-4ca1-a1b5-6d09e73ae0b9","resolution":{"observed_at":"2026-08-10T10:47:44.731096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-10T10:47:43.975914Z","title":"Evaluating object hallucina- tion in large vision-language models.arXiv preprint arXiv:2305.10355, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.975914Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:b4c26a85b28198b69b379b337c92c8ec5c5a9d334f45257980b5a30d3844e0b5","observation_id":"dcc333b6-e883-47d0-ab57-4aae01192727","resolution":{"observed_at":"2026-08-10T10:47:43.975914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.979840Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.979840Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:6373606aa7caad471425d0cb4140714f74993b18a093e2d1182c68446226b1bd","observation_id":"eabe12cc-a553-4028-b6fd-31e4c2dd20f1","resolution":{"observed_at":"2026-08-10T10:47:43.979840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14565","last_updated":"2024-03-19T22:53:25Z","snapshot_observed_at":"2026-08-06T22:33:34.254048Z","submitted_at":"2023-06-26T10:26:33Z","title":"Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14565","snapshot_observed_at":"2026-08-10T10:47:43.983427Z","title":"Mitigating hallucination in large multi-modal models via robust instruction tuning.arXiv preprint arXiv:2306.14565, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.983427Z"},"links":{"cited_paper":"/paper/2306.14565","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:4c318fb5db29bf0e388d1c43855760e9362a06764d5db63bdd4c49f3469140a5","observation_id":"887a82ea-f4bb-42a5-adde-1e19b3be83ff","resolution":{"observed_at":"2026-08-10T10:47:43.983427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.987399Z","title":"Visual instruction tuning.Advances in neural information processing systems, 36:34892–34916, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.987399Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:b8979556342f9ecda01bf6d0b72cd1d134bb77036a9691f6860ac2a5a78dcea7","observation_id":"fa1b95be-cf8f-4b06-bee2-bf17ed85f7a0","resolution":{"observed_at":"2026-08-10T10:47:43.987399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.698690Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"33c285ff-12ad-4a18-afb6-f5ab8516f235","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.990877Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:7fca678f642de0d46e42ae323beccd907330554d0c873d5660f4ba5a7f08e8c9","observation_id":"ab154c61-d930-40b6-8d2b-c4691ab32fa9","resolution":{"observed_at":"2026-08-10T10:47:44.702842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-08-11T03:31:28.001151Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-10T10:47:43.994864Z","title":"A survey on hallucination in large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.994864Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:0cb4fc615663067c3f568a28b00b1111d910057ced72c50203435f0efa7441ce","observation_id":"e3ca8da4-6f46-4fb1-b164-22c40ec6631c","resolution":{"observed_at":"2026-08-10T10:47:43.994864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.685241Z","title":"Paying more at- tention to image: A training-free method for alleviating hal- lucination in lvlms","venue":null,"work_id":"78a77dab-d718-4d27-b7fa-500d309b68a8","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.998702Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:5218626607c0b01b8e1fcffc9c555135dcc95d07b575ba5ecf1dbc6ef8524c9c","observation_id":"53c0377c-6c8c-43b3-9eef-9b2059253bd3","resolution":{"observed_at":"2026-08-10T10:47:44.689548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.672407Z","title":"Alleviating hallucinations in large vision- language models through hallucination-induced optimiza- tion.Advances in Neural Information Processing Systems, 37:122811–122832, 2024","venue":null,"work_id":"2136870b-0645-484c-9e6a-821b4791ec43","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.002374Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:0418443995b49e9ba72d367100929b320f684c5b01652edf78d8afe6ffa640f5","observation_id":"88eb18a9-d520-4dd6-9d9f-56240c02f130","resolution":{"observed_at":"2026-08-10T10:47:44.676793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.660561Z","title":"Wordnet: a lexical database for english","venue":null,"work_id":"a6bf41e9-6485-4a20-98a3-1e68eb55b016","year":1995},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.006316Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:38834a78a6f599a9efe9409c9f0bf13663b61bda36ec3314c9821cbf7b9120ef","observation_id":"9f54d766-b08b-440c-9f24-7a90343b4901","resolution":{"observed_at":"2026-08-10T10:47:44.664276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.649170Z","title":"Interpreting gpt: The logit lens","venue":null,"work_id":"50e41aab-a5d7-45ee-a190-c59d48dc7ee9","year":2020},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.010190Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:ce61f1713eddbaf108ef35726c5f733b73317871cb47e277e9165101a42df598","observation_id":"c721d87f-671f-40b3-b4d1-e4b82b481a6d","resolution":{"observed_at":"2026-08-10T10:47:44.653301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.014328Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.014328Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:d527cf1a73488d0aedaff3a7f3823da667702e3f0fe07af12a666c38282b1788","observation_id":"8790dd97-557f-4dd7-b86d-cdfdb9a45777","resolution":{"observed_at":"2026-08-10T10:47:44.014328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-10T08:25:28.506770Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-10T10:47:44.018119Z","title":"Object hallucination in image cap- tioning.arXiv preprint arXiv:1809.02156, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.018119Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:03b92dc89adf114b13467a554eb5fcdab9cd65f359e6f27bd6ddf1feacd3664f","observation_id":"f4768a1b-8578-41a1-89c9-2e7b3fa691ed","resolution":{"observed_at":"2026-08-10T10:47:44.018119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18654","last_updated":"2025-02-28T00:26:42Z","snapshot_observed_at":"2026-08-04T21:04:25.264907Z","submitted_at":"2024-05-28T23:36:00Z","title":"Mitigating Object Hallucination in MLLMs via Data-augmented Phrase-level Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18654","snapshot_observed_at":"2026-08-10T10:47:44.022178Z","title":"Mitigating ob- ject hallucination in mllms via data-augmented phrase-level alignment.arXiv preprint arXiv:2405.18654, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.022178Z"},"links":{"cited_paper":"/paper/2405.18654","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:5417375f790a4773584037f1786a798ba5055f60e1e053db593eb68c580ee1bb","observation_id":"44ff7873-12ee-4b4f-a979-a48396d2dd0a","resolution":{"observed_at":"2026-08-10T10:47:44.022178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06225","last_updated":"2025-08-18T12:00:32Z","snapshot_observed_at":"2026-08-08T19:02:29.037600Z","submitted_at":"2025-08-08T11:11:22Z","title":"Overconfidence in LLM-as-a-Judge: Diagnosis and Confidence-Driven Solution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.06225","snapshot_observed_at":"2026-08-10T10:47:44.026423Z","title":"Over- confidence in llm-as-a-judge: Diagnosis and confidence- driven solution.arXiv preprint arXiv:2508.06225, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.026423Z"},"links":{"cited_paper":"/paper/2508.06225","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:34c87c6e5b37a903bed93a83dc272d4c8acfbbe11eab9928c8a070bce830723b","observation_id":"db768d3b-9524-429e-b314-8d5741a8c656","resolution":{"observed_at":"2026-08-10T10:47:44.026423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.630348Z","title":"Eyes wide shut? exploring the visual shortcomings of multimodal llms","venue":null,"work_id":"c0be7d9e-ee66-4097-92c4-9dff65f5a4bb","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.030588Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:1aecf9a1fc6f9d05742879d5d71744d0641ce02e1fc025ce1ffb09138ff4c291","observation_id":"6162e675-7f02-4ab3-8c82-3394dccfaeac","resolution":{"observed_at":"2026-08-10T10:47:44.634588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11779","last_updated":"2025-02-23T15:14:47Z","snapshot_observed_at":"2026-08-10T13:18:33.995677Z","submitted_at":"2024-10-15T16:57:44Z","title":"MLLM can see? Dynamic Correction Decoding for Hallucination Mitigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11779","snapshot_observed_at":"2026-08-10T10:47:44.034645Z","title":"Mllm can see? dynamic correction decoding for hallucination mitiga- tion.arXiv preprint arXiv:2410.11779, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.034645Z"},"links":{"cited_paper":"/paper/2410.11779","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:f79677879cc1eeb4b68de82acedf5d7f6b6b933e31ce1ee066c044b2086d244d","observation_id":"649df8aa-6029-4b67-a3ca-17bab84bd5be","resolution":{"observed_at":"2026-08-10T10:47:44.034645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07397","last_updated":"2024-02-23T07:54:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T15:25:42Z","title":"AMBER: An LLM-free Multi-dimensional Benchmark for MLLMs Hallucination Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07397","snapshot_observed_at":"2026-08-10T10:47:44.038832Z","title":"Amber: An llm-free multi-dimensional bench- mark for mllms hallucination evaluation.arXiv preprint arXiv:2311.07397, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.038832Z"},"links":{"cited_paper":"/paper/2311.07397","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:ce7eb0349b1aafb8d2482586c7c7b19b239e13a463b23ab33ed0cb1cfcc4d596","observation_id":"55a95a22-9657-428c-8997-9ae74d884b58","resolution":{"observed_at":"2026-08-10T10:47:44.038832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-10T10:47:44.043045Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.043045Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:0135de89fc05c732944cf1daa3b76cbdd2981b98614570a7edfce47f1cf9b3b6","observation_id":"910c0aa5-a815-46c1-83b3-d77486dd8de7","resolution":{"observed_at":"2026-08-10T10:47:44.043045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10552","last_updated":"2025-08-14T11:44:52Z","snapshot_observed_at":"2026-08-09T07:24:43.212927Z","submitted_at":"2025-08-14T11:44:52Z","title":"When Language Overrules: Revealing Text Dominance in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10552","snapshot_observed_at":"2026-08-10T10:47:44.047025Z","title":"When language overrules: Revealing text domi- nance in multimodal large language models.arXiv preprint arXiv:2508.10552, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.047025Z"},"links":{"cited_paper":"/paper/2508.10552","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:f0e6af900a9f90f09a7e65a55ed7d80d5368e72495a564f97b08b3a79211c443","observation_id":"fe3929af-e1b9-4de8-a0b4-6ce2f51ee134","resolution":{"observed_at":"2026-08-10T10:47:44.047025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.618570Z","title":"Mitigating hallucinations in large vision- language models via dpo: On-policy data hold the key","venue":null,"work_id":"1a62caf1-274b-46d6-841e-59a0e0a43d87","year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.051227Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:b7c53415ddafd3f2ebf20ee2dcbb7079ee5a966aa5e35dc3ba40746ce0107bdd","observation_id":"4d20456f-62e9-461e-998d-1b1f65351d6d","resolution":{"observed_at":"2026-08-10T10:47:44.622766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.055257Z","title":"mplug- owl2: Revolutionizing multi-modal large language model with modality collaboration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.055257Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:864ebcb13474a34891e1d4ddea9f7a618ccc26c0353f8824e8874082e744809f","observation_id":"685cf51b-407d-4d66-8d5b-e202331a509f","resolution":{"observed_at":"2026-08-10T10:47:44.055257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.059547Z","title":"Clearsight: Vi- sual signal enhancement for object hallucination mitigation in multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.059547Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:ec1de3c62950db076f0c20c0a0f4cb2862d4221993c3ab883e3abdd7730e0155","observation_id":"d4c5925a-c39d-41ea-8266-012b2ff406ff","resolution":{"observed_at":"2026-08-10T10:47:44.059547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.589524Z","title":"Rlhf-v: Towards trustworthy mllms via behavior alignment from fine-grained correctional hu- man feedback","venue":null,"work_id":"1ba26b43-698c-423b-8dba-995c16b9ffc8","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.063506Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:763e9d9af29896b556a9d7e4c97c02699f63df728b0423cb29cb2b14db64c6d5","observation_id":"02458c0e-89e6-48e6-89a6-b0df3c721b8c","resolution":{"observed_at":"2026-08-10T10:47:44.593865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.574510Z","title":"Mitigating object hallucination in large vision-language models via classifier-free guidance.arXiv e-prints, pages arXiv–2402, 2024","venue":null,"work_id":"f691a42e-1bc5-48df-a5ed-125ab451508a","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.067679Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:02629119b10ea3260ec0f5e0c566454a013893e9a90ec0bbe1ea04d6b05bc73e","observation_id":"39a2c8f4-0a3a-4fac-9053-2ff1554b32bc","resolution":{"observed_at":"2026-08-10T10:47:44.580796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16839","last_updated":"2024-02-06T16:43:31Z","snapshot_observed_at":"2026-08-08T04:17:23.797697Z","submitted_at":"2023-11-28T14:54:37Z","title":"Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16839","snapshot_observed_at":"2026-08-10T10:47:44.071502Z","title":"Beyond hallucinations: Enhanc- ing lvlms through hallucination-aware direct preference op- timization.arXiv preprint arXiv:2311.16839, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.071502Z"},"links":{"cited_paper":"/paper/2311.16839","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:47ccdb3cf5a66bb98ca0df5b2087084904e10a22070f24d64207556bd89958a6","observation_id":"b4d8f383-ae8a-4296-ae4a-e8c09fd8a0e8","resolution":{"observed_at":"2026-08-10T10:47:44.071502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-08-10T10:47:44.075469Z","title":"Analyzing and mitigating object hallucination in large vision-language models.arXiv preprint arXiv:2310.00754,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.075469Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:7aa2966415c161ad2274d1d0e2f4acf2d1c2ae24fee6a10b57e26eb309a5f090","observation_id":"01dad650-bf56-4aed-9657-a284790b120b","resolution":{"observed_at":"2026-08-10T10:47:44.075469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T08:11:27.741528Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2608.07302."}