{"as_of":"2026-08-05T01:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:25e32545589419f1d977a494356a89a87d9d2ffbfa169bf1e05b7a56c3768db7","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T04:57:59.837094Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T23:33:16.095675Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T12:46:56.634866Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.20032","snapshot_observed_at":"2026-08-02T23:33:16.095675Z","title":"Tell model where to look: Mitigating hallucinations in mllms by vision-guided attention.ArXiv, abs/2511.20032,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.13600","last_updated":"2026-05-28T03:40:51Z","snapshot_observed_at":"2026-08-02T23:33:13.904850Z","submitted_at":"2026-02-14T04:44:37Z","title":"SAVAA: Mitigating Hallucinations in LVLMs via Step-wise Adaptive Visual Attention Amplification","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T23:33:16.095675Z"},"links":{"cited_paper":"/paper/2511.20032","citing_paper":"/paper/2602.13600"},"observation_digest":"sha256:f7b15f345e5ce053f39c8a3b8dfc4505ca0702fe0a2feeeaee1560d508308fbf","observation_id":"ed78946e-2ef0-4321-814d-3a54309d0d58","resolution":{"observed_at":"2026-08-02T23:33:16.095675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"cited_work":{"arxiv_id":"2511.20032","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.20032","snapshot_observed_at":"2026-07-02T12:46:56.634866Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","venue":"cs.CV","work_id":"85f1b2ff-bb36-4007-80a3-ba4420e67ebd","year":2025},"citing_paper":{"arxiv_id":"2606.05843","last_updated":"2026-06-04T08:18:31Z","snapshot_observed_at":"2026-08-04T11:24:17.403704Z","submitted_at":"2026-06-04T08:18:31Z","title":"Mechanistic Insights into Functional Sparsity in Multimodal LLMs via CoRe Heads","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T01:54:13.927736Z"},"links":{"cited_paper":"/paper/2511.20032","citing_paper":"/paper/2606.05843"},"observation_digest":"sha256:e40c851cc6f28a4369961f53d080e0d1f7a46140f4f5afa494742a29d15c5631","observation_id":"70ba121e-e0bd-4592-b597-c0ae3a14c80f","resolution":{"observed_at":"2026-07-02T12:46:56.636468Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"cited_work":{"arxiv_id":"2511.20032","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.20032","snapshot_observed_at":"2026-07-02T12:46:56.634866Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","venue":"cs.CV","work_id":"85f1b2ff-bb36-4007-80a3-ba4420e67ebd","year":2025},"citing_paper":{"arxiv_id":"2606.31054","last_updated":"2026-06-30T02:46:10Z","snapshot_observed_at":"2026-07-07T00:04:48.748126Z","submitted_at":"2026-06-30T02:46:10Z","title":"ADAPT: Attention Dynamics Alignment with Preference Tuning for Faithful MLLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-01T06:51:01.371390Z"},"links":{"cited_paper":"/paper/2511.20032","citing_paper":"/paper/2606.31054"},"observation_digest":"sha256:56fcdae2ff259e626d857f01b35b7700339b60070ce0a868d6ed7c61f09e9ca6","observation_id":"f44f9a0d-8a60-45ba-a916-943ba087f423","resolution":{"observed_at":"2026-07-01T06:55:29.470417Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.20032","snapshot_observed_at":"2026-08-01T03:42:52.863425Z","title":"InProceedings of the IEEE/CVF Confer- ence on Computer Vision and Pattern Recognition Findings, 8897–8906","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27667","last_updated":"2026-07-30T04:30:39Z","snapshot_observed_at":"2026-08-03T12:22:46.326782Z","submitted_at":"2026-07-30T04:30:39Z","title":"Witness Evidence Portfolios: Single-Prefill Risk Detection for Closed Multimodal Answers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T03:42:52.863425Z"},"links":{"cited_paper":"/paper/2511.20032","citing_paper":"/paper/2607.27667"},"observation_digest":"sha256:8b7a889d3e1f7262dcb7f5fca91137fbcd868c36ca0629b027f69ce589af78b6","observation_id":"50ae2b93-7c8c-4879-8d9a-9b83a4aa3cf7","resolution":{"observed_at":"2026-08-01T03:42:52.863425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2511.20032/citation-record","integrity":"/paper/2511.20032/integrity","json":"/paper/2511.20032/citation-record.json","paper":"/paper/2511.20032"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-07-11T01:17:45.013705Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:43922df5831a26808fcf0fe47ac6126488a7af50c74e45ec25bd26586112657e","observation_id":"1e2942f0-dedd-4b74-bdbe-48baf864aa97","resolution":{"observed_at":"2026-05-17T04:59:03.943257Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Per- turbollava: Reducing multimodal hallucinations with pertur- bative visual training","venue":null,"work_id":"852a9ae8-a131-40f6-bf5e-60d5b9c4cb5c","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:56aa0fd64a16cf1cf99a2229ee31ece5815b16118c845b6b148af19d4b11791d","observation_id":"64cf7382-21bb-487e-8ce0-761480506c13","resolution":{"observed_at":"2026-05-17T04:59:04.599961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Why is spatial reasoning hard for vlms? an attention mechanism perspective on focus areas","venue":null,"work_id":"c837122f-354c-49b8-aeac-ea59f542cdc3","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:17547a182b6d676344a650bbf0d3cb7c9335d2386ab12195d1b44ac6ec7bbe41","observation_id":"f5ac82f3-9d6e-42cb-b014-69ad224d2a8f","resolution":{"observed_at":"2026-05-17T04:59:04.602830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flashattention: Fast and memory-efficient exact at- tention with io-awareness","venue":null,"work_id":"4e506ec2-c531-477d-9d2c-2ffd71e9037d","year":null},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:70daa6429c905d9e48c481b73e6d03ecee0377cf85a78bdb095a010cd721a4dd","observation_id":"ef71d9a8-58f0-424d-9dd8-46e4b36be0d7","resolution":{"observed_at":"2026-05-17T04:59:04.589035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cracking the code of hallucination in lvlms with vision-aware head divergence","venue":null,"work_id":"84c2de8a-e1ba-442d-8ecb-3f6b3ad47484","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:01b184bc768812c0db0c3a9d297c08e5a3619d4cb4e5d4f79e413cba0cbbdb4d","observation_id":"28751829-d90b-465a-a9e3-361d4242be7f","resolution":{"observed_at":"2026-05-17T04:59:04.580395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Opera: Alleviating hallucination in multi- modal large language models via over-trust penalty and retrospection-allocation","venue":null,"work_id":"200b7710-b030-44bc-a576-dbde5f48a3b5","year":null},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:3ecc417200c380ab4ba6c2e3e5e98d8582f64250706fbc643ccc15dc2911eec0","observation_id":"b3c374af-cb7f-4981-9b2f-53d8d014ef53","resolution":{"observed_at":"2026-05-17T04:59:04.583360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interpreting and editing vision-language representations to mitigate hallucinations","venue":null,"work_id":"91823047-6899-4598-8dd5-96368d562f7d","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:40f331bc17a7e637058e6071b485a097aa16f8f9b9bc05ae8071327600a1df98","observation_id":"de05ee4b-4067-4ba3-be84-4ddb209ef486","resolution":{"observed_at":"2026-05-17T04:59:04.591870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"See what you are told: Visual attention sink in large multimodal models","venue":null,"work_id":"99454b70-6166-460c-9527-048358bdb81f","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:7249524a9ab423250e6532a167c0797331335cd8e40dae9624e8f64ced7c7358","observation_id":"00e02cf0-9c91-41a2-a255-59b4d9a11d90","resolution":{"observed_at":"2026-05-17T04:59:04.597282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mitigating object hal- lucinations in large vision-language models through visual contrastive decoding","venue":null,"work_id":"d9d2783c-d436-4d1e-b212-052511cdea57","year":2024},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:f068f27a1177c59173fc5ad5f8d2d00807ee23b453c957f10f9231002cb66a1b","observation_id":"d56d0339-ac49-48b3-95b0-57c6a1aca440","resolution":{"observed_at":"2026-05-17T04:59:04.577422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Treble counterfactual vlms: A causal approach to hallucination","venue":null,"work_id":"cd7b35e3-6591-43b3-b329-8fe2b515807c","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:95050b82bc7773b22e9717da1bec861cfb3896fcefcd7f59ce45503b66627174","observation_id":"24c4ac0a-195e-42be-bb8a-7190c3105699","resolution":{"observed_at":"2026-05-17T04:59:04.586157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating object hallucination in large vision-language models","venue":null,"work_id":"f0372bb5-fd41-4399-ad68-414b866f145c","year":null},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:daa27e0129d173c705d74742780e22f77315e78e64d4c83fabff555b15fb7274","observation_id":"7d894311-e9f5-4568-a602-4dd54c9a5d95","resolution":{"observed_at":"2026-05-17T04:59:04.568353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual in- formation steering","venue":null,"work_id":"d0650631-c3f7-4486-9f11-0b26bde4c408","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:da4983a9519119527bee6ebed3d3e0ea8134b5aa4272bf072643bc9baa830089","observation_id":"e2a7999e-bcf0-400d-9d92-9a9494fd18b9","resolution":{"observed_at":"2026-05-17T04:59:04.574394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"45ae3b39-8459-45d0-8ddd-407a79fb2494","year":2014},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:11b89dbfe9746f662b1a4d0e5b29a163fac4f6a23bf904a631af20cd6f7f95ac","observation_id":"220c7cbf-3945-4868-8ce7-b98f962baab7","resolution":{"observed_at":"2026-05-17T04:59:04.571365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"31440db3-b763-4b96-a5ff-fa87eddbe376","year":2024},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:ec2c25b61dd7f3345a3f0110491c5d65b6c2c405c4dd823aa4940cbdda10074c","observation_id":"61955323-7b52-40bf-ad4b-ac6e49dd5b8a","resolution":{"observed_at":"2026-05-17T04:59:04.594481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llava-next: Im- proved reasoning, ocr, and world knowledge","venue":null,"work_id":"506249db-5dee-4cf2-84ec-166b0eb3d386","year":2024},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:28329c8329203da9f02f714ed640b0bfe38d2cee63ccd30ce031148fed3478fe","observation_id":"60e3dce2-547c-455e-b964-dbd3e2c681d1","resolution":{"observed_at":"2026-05-17T04:59:04.606025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Paying more at- tention to image: A training-free method for alleviating hal- lucination in lvlms","venue":null,"work_id":"61c8bc40-b503-42ba-b43d-58fd3c0fcac5","year":2024},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:46193d13ff0ff37aff4692d8aa314eb91c73d765d7ef7889e4c178a0f06f8d1e","observation_id":"8d15d819-ebe9-409d-af06-9bb069a448b8","resolution":{"observed_at":"2026-05-17T04:59:04.565437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.11712","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T10:48:02.096668Z","title":"Mitigating hallucination through theory-consistent symmetric multimodal preference optimization","venue":null,"work_id":"2ae65219-5d37-4dce-9cf9-d89a5e972c78","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:962a8cf6ff64c69684443f79c41619bf9ce18eda48c2b42084a657c697bef398","observation_id":"28ee871c-c11c-4ca6-8f6c-da0c583920ae","resolution":{"observed_at":"2026-05-17T04:59:03.924426Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Second: Mitigating perceptual hallucination in vision- language models via selective and contrastive decoding","venue":null,"work_id":"7accee0f-e37b-44c2-9ecc-8b5a762e4a0a","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:f8f58de0f942a4a3ca59cb9baa690af08c893e8153171a81a122042eaf0f8a03","observation_id":"4a467014-6d47-401f-a7b5-6011de4a5f25","resolution":{"observed_at":"2026-05-17T04:59:04.556498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stanza: A python natural language processing toolkit for many human languages","venue":null,"work_id":"2629241d-e4c7-49cc-8ebd-302fdb4bb046","year":2020},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:6a4bcc9dc098cbac1e332fb31158d8d1789e205216cde8b12ee6c9d5ba325dbb","observation_id":"e73dff2d-61e6-4c51-b099-475b64998976","resolution":{"observed_at":"2026-05-17T04:59:04.546708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Object hallucination in image cap- tioning","venue":null,"work_id":"9ad9d1d0-840e-4154-960d-3ea6a951b382","year":2018},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:4f257d71042e65cd8fa3582a9badd832a4eeba6efa238a3cf0dc09b334eda495","observation_id":"0ab666fb-9148-4993-989d-697d2f94bd89","resolution":{"observed_at":"2026-05-17T04:59:04.553379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mitigating ob- ject hallucination in mllms via data-augmented phrase-level alignment","venue":null,"work_id":"d55058dd-23cd-443a-ba97-66e1af675b41","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:b36664e8f53e63b21fabe36f6bf3b57cf692a3f441a130a618a01054e6aae479","observation_id":"175effb1-4b33-4c7b-b297-6b8c0ceb7ca7","resolution":{"observed_at":"2026-05-17T04:59:04.543532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07397","last_updated":"2024-02-23T07:54:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T15:25:42Z","title":"AMBER: An LLM-free Multi-dimensional Benchmark for MLLMs Hallucination Evaluation","version":2},"cited_work":{"arxiv_id":"2311.07397","doi":"10.48550/arxiv.2311.07397","metadata_source":"pith","pith_arxiv_id":"2311.07397","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"AMBER: An LLM-free Multi-dimensional Benchmark for MLLMs Hallucination Evaluation","venue":"cs.CL","work_id":"22a93312-ad15-41b3-b076-8a1142f59fad","year":2023},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"cited_paper":"/paper/2311.07397","citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:27bc91bba2d3172882e10713c6aea6c0e30b3a8a7fa4a84b85fc6c827cb80cbf","observation_id":"3a6c6808-7b3e-488e-b724-536632b5001d","resolution":{"observed_at":"2026-05-17T04:59:03.939203Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:07.397187+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:07.397187+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Damo: Decoding by accumulating activations mo- mentum for mitigating hallucinations in vision-language models","venue":null,"work_id":"b267c6a1-5929-4ff9-a0ae-febef8afb058","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:61d8326def7da82f0b6cd8ee2e2688c1693447a99ea0d1a807bb6b5c68120a44","observation_id":"3a75a718-d55f-4de1-851f-cde76af95676","resolution":{"observed_at":"2026-05-17T04:59:04.550045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Detecting and mitigating hallucination in large vi- sion language models via fine-grained ai feedback","venue":null,"work_id":"b077fc6a-6d18-43c6-9a53-323217d7143b","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:7a9ee4a3fe827a2162a24eee004a0c782a69e1709fc5496101a57f9c5746795b","observation_id":"063c6488-ec1d-4eb1-bbb8-743809c56075","resolution":{"observed_at":"2026-05-17T04:59:04.559590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04099","last_updated":"2026-04-13T13:08:28Z","snapshot_observed_at":"2026-08-01T12:54:19.360091Z","submitted_at":"2025-04-05T07:57:11Z","title":"TARAC: Mitigating Hallucination in LVLMs via Temporal Attention Real-time Accumulative Connection","version":2},"cited_work":{"arxiv_id":"2504.04099","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.04099","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TARAC: Mitigating Hallucination in LVLMs via Temporal Attention Real-time Accumulative Connection","venue":"cs.CV","work_id":"d039960b-bbe8-4f0d-9721-bee416f936f8","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"cited_paper":"/paper/2504.04099","citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:ce3a00ea2303494fcdb6b2561cb7db9524684f56c3c2ee599045e5da44474af7","observation_id":"05bd781f-5a76-4054-8492-9a0eadfd7133","resolution":{"observed_at":"2026-05-17T04:59:03.947695Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Un- derstanding and mitigating hallucination in large vision- language models via modular attribution and intervention","venue":null,"work_id":"e15c055a-5303-4d32-baf1-d1b530ba0f4f","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:fa40b6833924e684b8faf01dd93c5be12d85e8a25f6c40fd50274b55038dc8c1","observation_id":"07ca6d34-7679-4ec9-a3c2-f54bd28a7e99","resolution":{"observed_at":"2026-05-17T04:59:04.540043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clearsight: visual signal enhancement for object hallucination mitigation in multimodal large language models","venue":null,"work_id":"f347558b-daf6-4b50-841e-9b5780ae72fa","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:c548f54dd3df354c0f0524fc7ba0cbe18755919d89ea0ba3e7709af324820c35","observation_id":"1549e680-a5b8-467e-848e-d9f8a3fccc04","resolution":{"observed_at":"2026-05-17T04:59:04.536068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lifting the veil on visual information flow in mllms: Unlocking pathways to faster inference","venue":null,"work_id":"23728e79-eda2-4465-b7fd-ff3a6c6715cb","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:6c26d9a181d21e00d69f5fb0f6a61dae44e70f058e07a21db043347daf1ceee9","observation_id":"a39d53db-e30c-47a9-a05a-2f5496ee4b63","resolution":{"observed_at":"2026-05-17T04:59:04.532067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Woodpecker: Hallucination correction for multimodal large language models.Science China Information Sciences, 67(12):220105","venue":null,"work_id":"4a00c669-af41-4ca8-9fdc-dc76710d0aba","year":2024},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:43f439e2296dbb1fffbe5b83e77c05dc95a8dab3b9d44409ea246bdf9579d9a4","observation_id":"69d686a6-33e2-4e1e-88c1-e105a0370b74","resolution":{"observed_at":"2026-05-17T04:59:04.520514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self- correcting decoding with generative feedback for mitigating hallucinations in large vision-language models","venue":null,"work_id":"73a9ee4a-3d39-405b-8683-e540dcdbc819","year":null},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:7ce45f84c25e0d953b61f62867df64ae6807c01161fffc89d7e98a3fdd2d5bb3","observation_id":"6e4e3eb8-dee3-4ef3-bb26-c7e81946f282","resolution":{"observed_at":"2026-05-17T04:59:04.524354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-modal information flow in multimodal large language models","venue":null,"work_id":"beac1c73-afbc-4a74-ac6f-901a883bbbc6","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:89d6ecd0ddb4e57213e739f201d6fe5b240b4073c2a7f75a0dc3af50a8efc1a9","observation_id":"e18fd529-69e6-4987-bcf4-1616206d51d7","resolution":{"observed_at":"2026-05-17T04:59:04.528176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.10634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:22:46.882021Z","title":"Cross- image contrastive decoding: Precise, lossless suppression of language priors in large vision-language models","venue":null,"work_id":"239d562e-9439-4071-899a-5e6ebb5d7bcb","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:5b70623fa902f83fe081ba55d3d47f14dbee02079ada072ee39010f22ba268eb","observation_id":"b8cc7494-6ae7-4373-9821-61c3af417a30","resolution":{"observed_at":"2026-05-17T04:59:03.934743Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Align- ing attention distribution to information flow for hallucina- tion mitigation in large vision-language models","venue":null,"work_id":"cdcd0a8f-4ee6-41b0-85d7-0cfbc3825d1f","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:bc3d7fdbdd97539abbc57807099cd9b3fc8979e5e6c1f2d9fc3e0169f426ff3d","observation_id":"2a8a0232-2b5c-4309-9528-531825338f56","resolution":{"observed_at":"2026-05-17T04:59:04.513481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.12897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-layer vision smoothing: Enhancing visual understanding via sustained focus on key objects in large vision-language models","venue":null,"work_id":"e895dfc3-b469-40a4-9919-2fd84b63e208","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:2a66e22273447492dc4fdb5db4cbb977ec9aa471a0201cd1ac155a2bd400203b","observation_id":"ee9038c4-deb6-493b-a6db-c976d7bb05f4","resolution":{"observed_at":"2026-05-17T04:59:03.929547Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mitigating object hallucination in large vision-language models via image-grounded guidance","venue":null,"work_id":"3d3a704f-71f8-4eec-bba7-9d4ef272c934","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:57f8e068b475d49f0ebb0db92a863c0d583d6026a0e6079f7aabddce0de53f9c","observation_id":"23c1efdc-3866-4516-ae2b-dcd57cebca86","resolution":{"observed_at":"2026-05-17T04:59:04.516838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ibd: Alleviating hallucinations in large vision- language models via image-biased decoding","venue":null,"work_id":"983dcc36-18d1-4eb6-a41e-66fa48192a55","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:5048c66a10b9f4bea88adf45fd3e59e7cbfb030402bdcb46a561ffc2179a80b9","observation_id":"833987f2-e7aa-495d-9375-5647a3043954","resolution":{"observed_at":"2026-05-17T04:59:04.510496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Look twice before you answer: Memory- space visual retracing for hallucination mitigation in multi- modal large language models","venue":null,"work_id":"abd9cadf-f2a7-45ae-9581-a3f83113ffe8","year":2025},"citing_paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-17T04:57:59.837094Z"},"links":{"citing_paper":"/paper/2511.20032"},"observation_digest":"sha256:93fb1bb603083c597f76c14901314872dbecad95ac7bd78f4bf8da9d0ebe5b36","observation_id":"c875a36b-3b4f-43f8-9311-0dd1feb7d7a3","resolution":{"observed_at":"2026-05-17T04:59:04.562505Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2511.20032","last_updated":"2026-04-29T04:41:31Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T07:58:57Z","title":"Tell Model Where to Look: Mitigating Hallucinations in MLLMs by Vision-Guided Attention"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":6,"verified_fuzzy":30},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 4 inbound Pith citation observations for arXiv:2511.20032."}