{"as_of":"2026-08-09T21:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f18f7cff8e4373b33634e5bcc77e92a868057e02de2419e4b09df52c5538571c","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:13:15.203711Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T23:19:55.558166Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-10T12:15:01.137692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2507.00898","doi":"10.48550/arxiv.2507.00898","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00898","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Q., Stepputtis, S., Morency, L.-P., Ramanan, D., Sycara, K., and Xie, Y","venue":null,"work_id":"48d79968-2876-497c-ab80-5effbe6d983d","year":2025},"citing_paper":{"arxiv_id":"2602.11824","last_updated":"2026-05-11T06:09:34Z","snapshot_observed_at":"2026-07-06T22:45:39.557598Z","submitted_at":"2026-02-12T11:07:44Z","title":"Revis: Sparse Latent Steering to Mitigate Object Hallucination in Large Vision-Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T05:06:24.973439Z"},"links":{"cited_paper":"/paper/2507.00898","citing_paper":"/paper/2602.11824"},"observation_digest":"sha256:74bae85b8daaa044e9e7020b0cba54ca0faaec34301874b5305c78dc57d367c5","observation_id":"a6b45afc-743a-42c1-a244-4009a2519ade","resolution":{"observed_at":"2026-05-16T05:07:20.443129Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2507.00898","doi":"10.48550/arxiv.2507.00898","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00898","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Q., Stepputtis, S., Morency, L.-P., Ramanan, D., Sycara, K., and Xie, Y","venue":null,"work_id":"48d79968-2876-497c-ab80-5effbe6d983d","year":2025},"citing_paper":{"arxiv_id":"2604.17982","last_updated":"2026-04-20T09:04:49Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:04:49Z","title":"Mitigating Multimodal Hallucination via Phase-wise Self-reward","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T05:10:45.144421Z"},"links":{"cited_paper":"/paper/2507.00898","citing_paper":"/paper/2604.17982"},"observation_digest":"sha256:d0e381fa07c4376a9bca0512f8f1fb14b08eb2aafdc4f58cd4cfc486052178a8","observation_id":"6d6f5d86-d98e-401e-969c-655fe4468e46","resolution":{"observed_at":"2026-05-10T09:38:43.287163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2507.00898","doi":"10.48550/arxiv.2507.00898","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00898","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Q., Stepputtis, S., Morency, L.-P., Ramanan, D., Sycara, K., and Xie, Y","venue":null,"work_id":"48d79968-2876-497c-ab80-5effbe6d983d","year":2025},"citing_paper":{"arxiv_id":"2604.21027","last_updated":"2026-08-02T16:15:42Z","snapshot_observed_at":"2026-08-06T23:24:26.820832Z","submitted_at":"2026-04-22T19:18:36Z","title":"HypEHR: Hyperbolic Modeling of Electronic Health Records for Efficient Question Answering","version":1},"reference_index":218,"source":"arxiv_source","source_observed_at":"2026-05-09T23:51:47.724033Z"},"links":{"cited_paper":"/paper/2507.00898","citing_paper":"/paper/2604.21027"},"observation_digest":"sha256:4ca7ff01671d7b946038a70f93bd16e695cc0a6b290394a522ec1da9fc422860","observation_id":"2e9493c2-8603-4956-a1e6-7a07beb9c123","resolution":{"observed_at":"2026-05-09T23:54:45.699179Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2507.00898","doi":"10.48550/arxiv.2507.00898","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00898","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Q., Stepputtis, S., Morency, L.-P., Ramanan, D., Sycara, K., and Xie, Y","venue":null,"work_id":"48d79968-2876-497c-ab80-5effbe6d983d","year":2025},"citing_paper":{"arxiv_id":"2605.11808","last_updated":"2026-05-12T09:03:19Z","snapshot_observed_at":"2026-07-06T23:23:34.924221Z","submitted_at":"2026-05-12T09:03:19Z","title":"Mitigating Action-Relation Hallucinations in LVLMs via Relation-aware Visual Enhancement","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-13T05:44:05.093926Z"},"links":{"cited_paper":"/paper/2507.00898","citing_paper":"/paper/2605.11808"},"observation_digest":"sha256:6a158c65e5c55a5dd68ee2ecdf9ade3bb9247eee458437c47f1c0a05ac0a1599","observation_id":"8317148d-ad5d-4545-8321-0f26ba1e3ee3","resolution":{"observed_at":"2026-05-13T05:47:21.420670Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2507.00898","doi":"10.48550/arxiv.2507.00898","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00898","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Q., Stepputtis, S., Morency, L.-P., Ramanan, D., Sycara, K., and Xie, Y","venue":null,"work_id":"48d79968-2876-497c-ab80-5effbe6d983d","year":2025},"citing_paper":{"arxiv_id":"2605.31457","last_updated":"2026-05-29T15:51:12Z","snapshot_observed_at":"2026-08-05T20:26:12.081479Z","submitted_at":"2026-05-29T15:51:12Z","title":"VisionPulse: Dynamic Visual Sparsity for Efficient Multimodal Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T23:13:15.593994Z"},"links":{"cited_paper":"/paper/2507.00898","citing_paper":"/paper/2605.31457"},"observation_digest":"sha256:fd267d3287466b20066e5806660f7246587eed65fdc4f42aba5e8b092577fbdc","observation_id":"392264aa-5eb5-4da6-a67e-93caf0c54a51","resolution":{"observed_at":"2026-06-29T00:12:50.561358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00898","snapshot_observed_at":"2026-07-31T23:19:55.558166Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24017","last_updated":"2026-07-27T05:30:19Z","snapshot_observed_at":"2026-08-07T18:41:23.375151Z","submitted_at":"2026-07-27T05:30:19Z","title":"Disentangling Semantic Attention from Structural Bias in the Attention Manifold","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-31T23:19:55.558166Z"},"links":{"cited_paper":"/paper/2507.00898","citing_paper":"/paper/2607.24017"},"observation_digest":"sha256:5557295f789740167017ce51418c554e2b3aa8c6841d6d41ac5dca56cfdfd639","observation_id":"3b239e49-df4a-4aeb-92f3-5bd34ab9d73b","resolution":{"observed_at":"2026-07-31T23:19:55.558166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.00898/citation-record","integrity":"/paper/2507.00898/integrity","json":"/paper/2507.00898/citation-record.json","paper":"/paper/2507.00898"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T21:13:13.761431Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:13.761431Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:ecb7b1c8a42d9f8f140ca40b1c750c4fb244f65f25a332e40416d8bb378790a9","observation_id":"54a40df1-2516-4178-a8b7-89b767f966c6","resolution":{"observed_at":"2026-08-06T21:13:13.761431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-06T21:13:13.787529Z","title":"Hallucination of multimodal large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:13.787529Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:e824cf2545e4376e8f8f884736b75fdc8740546e8ea275eadfc054964d19ef44","observation_id":"cf12b557-b6fb-4513-8b7a-c7c528b116a9","resolution":{"observed_at":"2026-08-06T21:13:13.787529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10185","last_updated":"2026-04-27T07:59:24Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:14:22Z","title":"Detecting and Evaluating Medical Hallucinations in Large Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10185","snapshot_observed_at":"2026-08-06T21:13:13.824166Z","title":"Detecting and evaluating medical hallu- cinations in large vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:13.824166Z"},"links":{"cited_paper":"/paper/2406.10185","citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:722fe957742112c114dda15bd2e41b389fd3276b420a00b371532c374fd2f184","observation_id":"f80870c9-3378-4174-a087-7dab42e349b1","resolution":{"observed_at":"2026-08-06T21:13:13.824166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.723654Z","title":"An image is worth 1/2 tokens after layer 2: Plug-and-play inference acceleration for large vision-language models","venue":null,"work_id":"fd9ddf70-482e-43b1-9cd7-614a10373243","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:13.861387Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:d3809a94265aa3997075b48cdda9ec872f5cebd53127bfcd31340dbd496f72d3","observation_id":"99ebc0c0-e415-4a54-88e2-7862ad04a3f1","resolution":{"observed_at":"2026-08-06T21:13:15.727760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16479","last_updated":"2023-11-27T09:30:02Z","snapshot_observed_at":"2026-08-09T15:58:21.146758Z","submitted_at":"2023-11-27T09:30:02Z","title":"Mitigating Hallucination in Visual Language Models with Visual Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16479","snapshot_observed_at":"2026-08-06T21:13:13.897579Z","title":"Mitigating hallucination in visual language models with visual supervi- sion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:13.897579Z"},"links":{"cited_paper":"/paper/2311.16479","citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:dbaefc77e9b651e8f754d77a47f0e0cbd6d5fb42399eee7e1589e41157252825","observation_id":"3b4151fa-716d-498f-a31f-ef1c5a242ddb","resolution":{"observed_at":"2026-08-06T21:13:13.897579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.714341Z","title":"HALC: Object hallucination reduc- tion via adaptive focal-contrast decoding","venue":null,"work_id":"e615d171-19cf-4421-ad14-2aa058c9f481","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:13.934353Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:36c4f2b4c5b66e8b797d1d9116630e3f436b52f526c204888bc746aff067b048","observation_id":"5b0ecc14-237b-489e-b3d7-f6d77b201b2c","resolution":{"observed_at":"2026-08-06T21:13:15.717883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.704252Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":"42fb1894-0c4d-4c3c-aaed-655764c4e6d5","year":2023},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:13.969904Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:9a32a7a1997c6f06fcc2ae5b6c908bb98301dec946e358bdca24e31c4fc429bd","observation_id":"2be08dd1-ceb6-44cc-ad33-8783f28d5c2d","resolution":{"observed_at":"2026-08-06T21:13:15.708025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.694399Z","title":"Glass, and Pengcheng He","venue":null,"work_id":"6cb6124a-1b9f-4ea0-9dea-eb645d96c9a3","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.006179Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:4e9dbf4d0d4171263abe75bfe743ae41399244edfacda7185404e79d2b000b35","observation_id":"256517e9-dd7f-4450-bc3b-50563b81a798","resolution":{"observed_at":"2026-08-06T21:13:15.698441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.685245Z","title":"Instructblip: towards general-purpose vision-language models with instruction tuning","venue":null,"work_id":"fb816a8a-3cf3-47c0-b8fa-0b8528929046","year":2023},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.032869Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:d9bbbab3ee80591b1d18b49bdcb9831f37c2e6f8249ac94f55a7c0ea4d14958b","observation_id":"093aa4d0-a7ba-4a80-8db9-18e1612da0c3","resolution":{"observed_at":"2026-08-06T21:13:15.688615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.675609Z","title":"Multi-modal hal- lucination control by visual information grounding","venue":null,"work_id":"0aad5b76-38c3-4807-9689-dee63919f456","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.071610Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:d55a48e37cd91bcf9d956964e9b19970723c311725d869a0c94e6d3fca078ab2","observation_id":"eb89ff8c-60ac-4469-9836-8e2cee858cf2","resolution":{"observed_at":"2026-08-06T21:13:15.679229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-06T21:13:14.107576Z","title":"Mme: A comprehensive evaluation bench- mark for multimodal large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.107576Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:57dbf725052162233f6be01b8422ad3955f7df28ebac0fad52ec263d3e301d29","observation_id":"8f0e428b-cbc4-4ed6-9ca8-f403f4b1988d","resolution":{"observed_at":"2026-08-06T21:13:14.107576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.665997Z","title":"Opera: Alleviating hallucination in multi- modal large language models via over-trust penalty and retrospection-allocation","venue":null,"work_id":"9b0ec4be-1703-4984-80b3-52670beaa279","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.144828Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:72ce637967e5b192bf2d79e151490361e0b16b721fd309454798f964d8390098","observation_id":"543dcbec-0950-4645-95d6-6b56d924b169","resolution":{"observed_at":"2026-08-06T21:13:15.669763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.656114Z","title":"Gqa: A new dataset for real-world visual reasoning and compositional question answering","venue":null,"work_id":"3448a222-018a-4974-b713-589ddff0df72","year":2019},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.170930Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:47db46262f63810c7ba26f1b2b4d56a68b218c34391d3b5bd94361d3028c925b","observation_id":"bdaadd7d-9954-4028-bc56-d7841f652ced","resolution":{"observed_at":"2026-08-06T21:13:15.659908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.646470Z","title":"Hallucination augmented contrastive learn- ing for multimodal large language model","venue":null,"work_id":"b1861ed8-3e30-47af-9eca-aa8e88250512","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.205144Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:9756e8c288429ea0a1683b11f007f477b140ecb25ae5fe1b328826841545098b","observation_id":"ed9b2e5f-978d-46c9-9702-32cb4ec8cae0","resolution":{"observed_at":"2026-08-06T21:13:15.649937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.634723Z","title":"Lisa: Reasoning segmentation via large language model","venue":null,"work_id":"bffadc87-e778-4b3a-bc6d-5c3cf4728641","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.242751Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:ceb9e4c04e0eef36bb1c540d4fae8c31e319404b619164347a0321016f5732ea","observation_id":"583c3cb7-738e-4a56-b79a-fcf6a9558645","resolution":{"observed_at":"2026-08-06T21:13:15.639318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.624227Z","title":"Mitigating object hal- lucinations in large vision-language models through visual contrastive decoding","venue":null,"work_id":"ecfa28c0-0213-42d0-98d9-14d3a13353f4","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.278847Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:3f80bbe0301fdc343ee7af2141f9f56ee16fba05b4ae8e4378d8c3d065490b3b","observation_id":"5c442e0b-a577-40d6-a1f1-a09d6a090f20","resolution":{"observed_at":"2026-08-06T21:13:15.628080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.614161Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"8f856322-c5ab-424f-87bf-9b4a302a2c5d","year":2023},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.304998Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:0bbc901402bb77284c535c05c9bd1dbbafb3028850872180183f1d3074ad7b17","observation_id":"b97d9b17-6ab7-4e70-b4ef-87d2540261f7","resolution":{"observed_at":"2026-08-06T21:13:15.618160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.604520Z","title":"Contrastive decoding: Open-ended text gener- ation as optimization","venue":null,"work_id":"39353669-2536-4b3d-a0d6-b32d90933e24","year":2023},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.321463Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:efcaee86fd5f57a9d7c17552f7636a4ef70407b34753c8e8b650aebc6999f2f6","observation_id":"03167bb8-1ec4-4cda-995e-88df1b76f23f","resolution":{"observed_at":"2026-08-06T21:13:15.608061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.595216Z","title":"Evaluating object hallucination in large vision-language models","venue":null,"work_id":"fa8e132d-285b-477c-b75e-6e64fb8348f2","year":2023},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.347124Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:907c46c686a07a40415fe592e0e026cb3d00a9f47cf4653252cfc0c7bd03204c","observation_id":"4fc8d79d-0eb5-4d26-8c4f-b6e7a41b6323","resolution":{"observed_at":"2026-08-06T21:13:15.598663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.585621Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"40e0fb27-ba98-4db2-b426-2150c9d7242f","year":2014},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.372432Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:39ed684cc84dba47b6bacadd2a7369fdf5f4d936e105c2820ebd91c21446fd36","observation_id":"026a6b61-09d3-41cf-8c6c-14f05c8821a8","resolution":{"observed_at":"2026-08-06T21:13:15.589453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:14.397803Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.397803Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:9d6b485f9d43ca68109952a7e195fb8953ebfd15cf54cd6cf4d179b195c7c62a","observation_id":"01eb5120-5060-40ec-bcd6-5ce2d8e0c117","resolution":{"observed_at":"2026-08-06T21:13:14.397803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:14.433661Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.433661Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:0b3d7270452abf842bb79a2f6297eacc75f814466af52e4951e318203be9ab97","observation_id":"109f6128-b6be-4263-95d4-f207f849e1f8","resolution":{"observed_at":"2026-08-06T21:13:14.433661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:14.468003Z","title":"Llava-next: Im- proved reasoning, ocr, and world knowledge, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.468003Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:83944e4b6726810b618f7e47f86bb5cc0726560988e524fdbb87d4224c47d0e3","observation_id":"ba36bca9-c390-4210-b01b-1ade9c46a3c8","resolution":{"observed_at":"2026-08-06T21:13:14.468003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-06T21:13:14.495601Z","title":"A survey on hallucination in large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.495601Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:8a4f170c24688145356b4fb4253b127a11d3241b2efa65404f3591b28a959266","observation_id":"4c482140-d349-47a8-a602-d93e0750a797","resolution":{"observed_at":"2026-08-06T21:13:14.495601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.559644Z","title":"Mmbench: Is your multi-modal model an all-around player? In European Conference on Computer Vision, pages 216–233","venue":null,"work_id":"16ab2927-5ac9-432c-ba3d-3b05db5be3e4","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.529961Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:49904438b128304cf0baa07bd695fda57a1efabe21d747aae70fe785a9e1b971","observation_id":"87fd5bb0-c528-430b-9d3f-d2d99c435ee5","resolution":{"observed_at":"2026-08-06T21:13:15.564040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.549679Z","title":"Alleviating hallucinations in large vision- language models through hallucination-induced optimiza- tion","venue":null,"work_id":"8d374a2a-529f-413f-b9f9-4b2fbdcb4664","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.565418Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:27a6db9b6824b250de013e399625d9de02e77989718c6c9f8c5a638ed8e02892","observation_id":"09e10d18-15f0-413f-b0f6-889c6133e5f1","resolution":{"observed_at":"2026-08-06T21:13:15.552998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.539196Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"24bb4d68-2ea7-4f28-bd6d-be37abdc2d47","year":2021},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.601114Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:1f6d0f48cfe928a1e5831e7ccfe226719c6f2b43ca5afac4e0d8c62e3df32b5b","observation_id":"f4c5b4da-0667-4283-a1f5-f45fcb3d51c0","resolution":{"observed_at":"2026-08-06T21:13:15.543345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.529988Z","title":"Object hallucination in image captioning","venue":null,"work_id":"18d4b15b-348c-49b3-be78-55592e40b7b9","year":2018},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.635871Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:4cae97951ad4de94a698b0685e0e4b96bb2f35aba7b9554eff8040ceb477bd7e","observation_id":"c8fada7b-f00a-4b14-afe4-91d329e5d795","resolution":{"observed_at":"2026-08-06T21:13:15.533533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.520577Z","title":"A-okvqa: A benchmark for visual question answering using world knowl- edge","venue":null,"work_id":"62ce0f81-f19e-4cc4-8690-3202f70e880f","year":2022},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.672037Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:b9e03fae367224f63bc8e955e084c2f3d41a9ef3cb64757230d31292664de7a1","observation_id":"66e7c1aa-db3b-4937-afc5-56edd760df57","resolution":{"observed_at":"2026-08-06T21:13:15.523769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.510908Z","title":"A mathematical theory of communi- cation","venue":null,"work_id":"3d973d61-4f29-441f-833e-3ac2250af12d","year":1948},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.707820Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:d8c0c9d8eedf54b82213f76e707cf960a47d74ad909145d33164b38a4a53ac30","observation_id":"5fc4fb16-9bf1-497b-af94-73d1a04bce6c","resolution":{"observed_at":"2026-08-06T21:13:15.514298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-06T21:13:14.742673Z","title":"Aligning large multi- modal models with factually augmented rlhf","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.742673Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:a7107f1dac256b65288b9c778cd58d5c675acc4487bf7fbefeea9693c5496a63","observation_id":"85aafc04-67f3-4324-882c-763922ad0371","resolution":{"observed_at":"2026-08-06T21:13:14.742673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:14.777285Z","title":"Eyes wide shut? exploring the visual shortcomings of multimodal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.777285Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:e4da5c4be829ccf6d4611c287cc231fe8b809e2101a16934d9dede342961d1b4","observation_id":"e8e30997-6934-4ac4-a3bc-b87b590a2939","resolution":{"observed_at":"2026-08-06T21:13:14.777285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T21:13:14.813564Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.813564Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:a9aa36358f8c7c509aa9844ff7f2345c84b97e93765d0dd8f71004adb01ffddc","observation_id":"e4fb4c0d-d185-4227-9d9e-cd9db625a80a","resolution":{"observed_at":"2026-08-06T21:13:14.813564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18291","last_updated":"2025-05-23T18:36:13Z","snapshot_observed_at":"2026-08-07T14:31:40.870595Z","submitted_at":"2025-05-23T18:36:13Z","title":"InstructPart: Task-Oriented Part Segmentation with Instruction Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18291","snapshot_observed_at":"2026-08-06T21:13:14.848661Z","title":"Instruct- part: Task-oriented part segmentation with instruction rea- soning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.848661Z"},"links":{"cited_paper":"/paper/2505.18291","citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:6413c2fd629b3ac4d9e392dca5b8709582bd9594e62fed768448eb629e23fc0b","observation_id":"f53809e7-6b66-4a09-8b0f-842177dd009a","resolution":{"observed_at":"2026-08-06T21:13:14.848661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.495769Z","title":"Mitigating hallucinations in large vision-language models with instruction contrastive decoding","venue":null,"work_id":"20358e04-c62f-4813-8f07-a83504cb7c35","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.884197Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:ede1cccee432b93177b7d01c7388b15909d26c9a77809b25621e343c81ee852d","observation_id":"e8261dd7-f68c-401e-8e59-cce4a7ec010a","resolution":{"observed_at":"2026-08-06T21:13:15.499202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.485929Z","title":"Det- toolchain: A new prompting paradigm to unleash detection ability of mllm","venue":null,"work_id":"5753a1e2-fedc-4bc2-85f4-10207436c749","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.919150Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:f0d6f951adc9d69d138548e148f9d747f02436d48e660842563305f7bff4885f","observation_id":"7d34cfcb-56d8-4cf1-b158-e7be95a71d82","resolution":{"observed_at":"2026-08-06T21:13:15.489926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.475339Z","title":"mplug-owl2: Revolutionizing multi-modal large language model with modality collaboration","venue":null,"work_id":"eb4f0327-314e-4811-abb8-38b47dba20d8","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.954513Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:480670551f8e45d260d6b0ab778822a39f3e853af234ddb0e174fc57956464e0","observation_id":"67b05c53-e09d-4b6a-8e09-2fe8c13109b8","resolution":{"observed_at":"2026-08-06T21:13:15.478822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16045","last_updated":"2024-12-11T02:46:29Z","snapshot_observed_at":"2026-08-08T00:11:31.801569Z","submitted_at":"2023-10-24T17:58:07Z","title":"Woodpecker: Hallucination Correction for Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16045","snapshot_observed_at":"2026-08-06T21:13:14.989837Z","title":"Woodpecker: Hallucination correction for multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.989837Z"},"links":{"cited_paper":"/paper/2310.16045","citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:143202cc1fd53538ee8d88ca437b4e046b7f03aa41380db4cb63034e78edd220","observation_id":"0c3c586c-1bdf-4b3f-91e5-02a2c06c0dc2","resolution":{"observed_at":"2026-08-06T21:13:14.989837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.464660Z","title":"MM-vet: Evaluating large multimodal models for integrated capabilities","venue":null,"work_id":"90d7b564-7665-4e85-a2f1-85b2410cc6aa","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:15.026025Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:64398a34793c639de2c33c41f9a91e34e267735a3fdd781a17044c2e10a13438","observation_id":"92c490ae-92a8-4598-8987-ac2a04ccb19a","resolution":{"observed_at":"2026-08-06T21:13:15.468279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.453661Z","title":"Contextual object detection with multi- modal large language models","venue":null,"work_id":"b0e72ec9-2d5f-40c6-aa3a-137fe2d2a935","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:15.061021Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:e6cd0b703fa4d71903479ef07f869e5eb08961d392a6acf47c190a0f24077adc","observation_id":"83132c60-9fdf-45fa-b3ac-b798d7762f33","resolution":{"observed_at":"2026-08-06T21:13:15.458051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.443698Z","title":"Incorpo- rating generative feedback for mitigating hallucinations in large vision-language models","venue":null,"work_id":"9521acb3-8add-4e49-8c2e-7ee77f94ebca","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:15.095788Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:17c7b1721bba5701bf480fef637e6234cb123b6f3efb1360566a66476a6d2e85","observation_id":"5ed954af-57ef-463e-b9d5-972cd331b0dd","resolution":{"observed_at":"2026-08-06T21:13:15.447559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.133064Z","title":"Vscan: Rethinking visual token reduction for efficient large vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:15.133064Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:4962a3fbc0c238bd0028d577860befa81b59ae50ed67c135952ec2111316c6a2","observation_id":"c2e08cec-7434-4bf9-98d3-41f949449c21","resolution":{"observed_at":"2026-08-06T21:13:15.133064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.432910Z","title":"Ma, Si- mon Stepputtis, Deva Ramanan, Russ Salakhutdinov, Louis- Philippe Morency, Katia P","venue":null,"work_id":"13a1f5fd-a87f-4470-922a-eedc24debe7e","year":2025},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:15.167107Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:9e62c172f89d63f0bcb2d7abac23a9d4565e62274c99b734fe5437c76edb4df0","observation_id":"4b938062-275a-441e-87ee-3550f9b29499","resolution":{"observed_at":"2026-08-06T21:13:15.437162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:13:15.420525Z","title":"Is there a {object} in the image?","venue":null,"work_id":"3815db5a-4131-40bc-bc6b-f2d5e2c221c0","year":2024},"citing_paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:15.203711Z"},"links":{"citing_paper":"/paper/2507.00898"},"observation_digest":"sha256:51509755597e547b821f514de9bae80f2fb036070db2aebb925703426df4427f","observation_id":"296f3db8-8ae8-4659-8d0f-59910f8d5aaa","resolution":{"observed_at":"2026-08-06T21:13:15.425541Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.00898","last_updated":"2025-07-01T16:01:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T10:42:07.640863Z","submitted_at":"2025-07-01T16:01:08Z","title":"ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":28},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 6 inbound Pith citation observations for arXiv:2507.00898."}