{"as_of":"2026-08-07T10:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a4f96135c04e0b17900fd924f3486a1ca503736094a325a20e58b3a142917d39","coverage":[{"denominator":92,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":92,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:09:12.703445Z","state":"measured"},{"denominator":94,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":94,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:51:38.455604Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T02:36:26.495175Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2507.09184","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.09184","snapshot_observed_at":"2026-07-02T02:36:26.495175Z","title":"arXiv preprint arXiv:2507.09184 , url=","venue":null,"work_id":"358ef024-f509-479a-89f1-14a1d3484ccf","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-01T16:17:19.756210Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-08T19:34:02.860270Z"},"links":{"cited_paper":"/paper/2507.09184","citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:23921323c3c2f119a1b652a8da3c4c24d6c508f7b624c29a267f7527f663ead1","observation_id":"81bf9e71-ab5f-44e4-ad37-d7abec4e2070","resolution":{"observed_at":"2026-05-09T05:50:25.867148Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2507.09184","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.09184","snapshot_observed_at":"2026-07-02T02:36:26.495175Z","title":"arXiv preprint arXiv:2507.09184 , url=","venue":null,"work_id":"358ef024-f509-479a-89f1-14a1d3484ccf","year":null},"citing_paper":{"arxiv_id":"2606.03569","last_updated":"2026-06-02T12:36:24Z","snapshot_observed_at":"2026-08-02T13:19:20.535572Z","submitted_at":"2026-06-02T12:36:24Z","title":"When Attention Collapses: Stage-Aware Visual Token Pruning from Structure to Semantics","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T10:51:38.455604Z"},"links":{"cited_paper":"/paper/2507.09184","citing_paper":"/paper/2606.03569"},"observation_digest":"sha256:2c6ed8b6301607d35fecac1f8fdcdd1bc7cf9bd18bf6c096da3ef63125363a66","observation_id":"f5d5434a-704e-48e1-8f08-2dcb379a58ea","resolution":{"observed_at":"2026-07-02T02:36:26.496640Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.09184/citation-record","integrity":"/paper/2507.09184/integrity","json":"/paper/2507.09184/citation-record.json","paper":"/paper/2507.09184"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T18:09:03.518459Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.518459Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:94ac0b925d9448cb279f4138ec0a8de8a19f8f733ad6a213a0bd321bd48fe3d0","observation_id":"fcebb80e-e67a-4e25-97e2-56bb1ba2fbeb","resolution":{"observed_at":"2026-08-06T18:09:03.518459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12718","last_updated":"2025-03-14T04:38:44Z","snapshot_observed_at":"2026-07-06T18:33:02.286642Z","submitted_at":"2024-06-18T15:38:41Z","title":"Mitigating Object Hallucinations in Large Vision-Language Models with Assembly of Global and Local Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12718","snapshot_observed_at":"2026-08-06T18:09:03.588889Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.588889Z"},"links":{"cited_paper":"/paper/2406.12718","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:83daa7e3265246da1c40461df35c297d66bdbf4d2f992cb0017bfcfbc6e8383e","observation_id":"5c794393-d107-468e-abe5-a893502100e3","resolution":{"observed_at":"2026-08-06T18:09:03.588889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T18:09:03.664319Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.664319Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:406945d3a3c7060e057f24bb9dfc50c29276312e1e9198249d1b377a2bafbd1f","observation_id":"e20b7a41-f9c0-40d7-a98e-2b6de4399a0c","resolution":{"observed_at":"2026-08-06T18:09:03.664319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-06T18:09:03.731474Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.731474Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:eadcf858e3ddb1db86143fcbdaf6c36a8293aecea8a780035f5b55bbde338fa5","observation_id":"067e49e4-3974-4d48-bb98-109e9af09b4f","resolution":{"observed_at":"2026-08-06T18:09:03.731474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15356","last_updated":"2025-04-01T02:38:09Z","snapshot_observed_at":"2026-07-06T18:19:13.078606Z","submitted_at":"2024-05-24T08:46:31Z","title":"Alleviating Hallucinations in Large Vision-Language Models through Hallucination-Induced Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15356","snapshot_observed_at":"2026-08-06T18:09:03.792864Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.792864Z"},"links":{"cited_paper":"/paper/2405.15356","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:29ea96b24c4410dacc147416fb0494f64a7e1c086866aebd426d87627c1284cc","observation_id":"9509723e-65e6-422a-91b3-75370563438b","resolution":{"observed_at":"2026-08-06T18:09:03.792864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:03.866461Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.866461Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:1a51d6da47a6e6cd8b37c90ac5e7859315159eeb4e467ebd1a69dae7d527f520","observation_id":"7afa340c-5787-4514-80c2-8beb8f73cb60","resolution":{"observed_at":"2026-08-06T18:09:03.866461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20330","last_updated":"2024-04-09T15:17:50Z","snapshot_observed_at":"2026-08-02T21:55:15.857183Z","submitted_at":"2024-03-29T17:59:34Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20330","snapshot_observed_at":"2026-08-06T18:09:03.923853Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.923853Z"},"links":{"cited_paper":"/paper/2403.20330","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:eac69b78ac8859e6e374821fab81a0f5fb1b905de5a80da568df8099c47641a1","observation_id":"562b6634-6288-45ed-ba49-a75756a652e9","resolution":{"observed_at":"2026-08-06T18:09:03.923853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:03.986681Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.986681Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:54a8fc656932b1f366b01911892fe2b6f425e9deddd6e1bc21637bc6b1562e72","observation_id":"5b1933be-8023-4e5b-8442-87bcb0ce6636","resolution":{"observed_at":"2026-08-06T18:09:03.986681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:04.064963Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.064963Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:1e11d5090b09fc18ac2e4308b3b98c7eb5c49b208f55a26eb840cdb2fcf0d9c3","observation_id":"8d1c7e93-45b5-4daf-ab47-9cc785785581","resolution":{"observed_at":"2026-08-06T18:09:04.064963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00425","last_updated":"2024-06-10T15:21:41Z","snapshot_observed_at":"2026-08-07T09:16:51.378562Z","submitted_at":"2024-03-01T10:21:52Z","title":"HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00425","snapshot_observed_at":"2026-08-06T18:09:04.223683Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.223683Z"},"links":{"cited_paper":"/paper/2403.00425","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:2c5a97bb43a4687adcb1db1ce9587e9f9f5dd8b6844ca9124bf17cfd773d5080","observation_id":"c5148b6f-529c-4d99-beaa-a12c442a3fb1","resolution":{"observed_at":"2026-08-06T18:09:04.223683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:04.347465Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.347465Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:706ee00a21534f31d70898b9ab704b224f288bd20029c1c00538fd4001386c11","observation_id":"919ab78e-c58b-473c-8983-4e7ab5955ec2","resolution":{"observed_at":"2026-08-06T18:09:04.347465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03883","last_updated":"2024-03-11T02:01:09Z","snapshot_observed_at":"2026-08-06T11:43:44.726916Z","submitted_at":"2023-09-07T17:45:31Z","title":"DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03883","snapshot_observed_at":"2026-08-06T18:09:04.462122Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.462122Z"},"links":{"cited_paper":"/paper/2309.03883","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:d9af924fac999aa5933fe53a4c6f775b7d0d3636df7eaf59d35aa0fcd44ac35c","observation_id":"2bdadda9-dd36-46b4-93f1-9e6881235220","resolution":{"observed_at":"2026-08-06T18:09:04.462122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14148","last_updated":"2025-04-21T04:04:53Z","snapshot_observed_at":"2026-07-06T19:35:44.200337Z","submitted_at":"2024-10-18T03:34:32Z","title":"Fine-Grained Verifiers: Preference Modeling as Next-token Prediction in Vision-Language Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14148","snapshot_observed_at":"2026-08-06T18:09:04.579677Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.579677Z"},"links":{"cited_paper":"/paper/2410.14148","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:3590eb1d37b968b62fba0c7ce99f83259ab1f4ce18616e6759974ba9158e8a59","observation_id":"bd65fe72-c4f8-4534-8bfa-5a2cad63128d","resolution":{"observed_at":"2026-08-06T18:09:04.579677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T18:09:04.692520Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.692520Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:e3f987fbbe245280a21bda71c015793b0c681f0f25e4a95e827b03f6ad3024ff","observation_id":"9e2e0012-5847-472b-a7e8-8431c276e1bb","resolution":{"observed_at":"2026-08-06T18:09:04.692520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:04.807581Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.807581Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:04b7d287e0402e523d0cfa6223972893f3538a61da764ea7df9bd51d7d35f581","observation_id":"e1ed03d6-08d3-44ef-ab43-bdaaa343c95b","resolution":{"observed_at":"2026-08-06T18:09:04.807581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10436","last_updated":"2024-11-15T18:56:01Z","snapshot_observed_at":"2026-07-06T19:51:05.604758Z","submitted_at":"2024-11-15T18:56:01Z","title":"Mitigating Hallucination in Multimodal Large Language Model via Hallucination-targeted Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10436","snapshot_observed_at":"2026-08-06T18:09:04.896638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.896638Z"},"links":{"cited_paper":"/paper/2411.10436","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:1839f42969690452512fc93f6fdeca946b1fb2d81c3dc29e658978240bc31362","observation_id":"6c1bdc78-d3d7-40f7-859c-d67faeb529a2","resolution":{"observed_at":"2026-08-06T18:09:04.896638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.049067Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.049067Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:2196caefadfcd5b31544256dcdbdf8e42986b555488459fc832f61818fbfecf2","observation_id":"2f502d20-b7fa-464f-abf4-36a3c5722491","resolution":{"observed_at":"2026-08-06T18:09:05.049067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.127900Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.127900Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:f50db7d64360d6524a6e8e334cf9ea64ddc18cec8c47702ef9f72d3f5ea10116","observation_id":"238d7245-9b99-473e-841c-077b6568201a","resolution":{"observed_at":"2026-08-06T18:09:05.127900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.379941Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.379941Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:dd068f896f1a1aeeec96fa511c565f3f1a0dcd3539d1d742667c5ca9d606c5dc","observation_id":"86ccd12d-3931-487a-93b3-21ff1e801e60","resolution":{"observed_at":"2026-08-06T18:09:05.379941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.517749Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.517749Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:6100ca89237715739d3bfd771368c4333aea52a3def5cd5c6e528ac8b2e15426","observation_id":"f64a32b0-92af-4606-b52c-c0d3c58db9f8","resolution":{"observed_at":"2026-08-06T18:09:05.517749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03105","last_updated":"2024-01-13T15:11:04Z","snapshot_observed_at":"2026-07-06T17:12:14.593202Z","submitted_at":"2024-01-06T02:02:34Z","title":"Incorporating Visual Experts to Resolve the Information Loss in Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03105","snapshot_observed_at":"2026-08-06T18:09:05.646100Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.646100Z"},"links":{"cited_paper":"/paper/2401.03105","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:ad2d617ff1929f07335c3201039327b8fa58c410fd27f2d9be629d3b5e98c700","observation_id":"81334f5d-63f5-4da6-8be4-d8f837c3ff1a","resolution":{"observed_at":"2026-08-06T18:09:05.646100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.749687Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.749687Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:b6ce71340f2eeb8f6198a074c77fdb58f9ba422b152674eb773df9a8cb056895","observation_id":"588c63e7-4251-4ee6-aee7-42ff6e68d7ba","resolution":{"observed_at":"2026-08-06T18:09:05.749687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.836181Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.836181Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:6bb160e8ff522f31759d882b8a2d7cc81125f78092fbc279afcda7ae3b3f215a","observation_id":"e4881b57-f331-4a78-9261-385bb74cc644","resolution":{"observed_at":"2026-08-06T18:09:05.836181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:06.011724Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.011724Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:32149db744b336f30a2c0a4ceb697a7f3ca3cdf26254ce1bc868c91ce1b0327b","observation_id":"c90e75ff-a607-4d07-9d3a-49d149b9e8f7","resolution":{"observed_at":"2026-08-06T18:09:06.011724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:17.521787Z","title":null,"venue":null,"work_id":"6986d9dc-c0dc-48eb-ba68-5b5f702a9915","year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.125436Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:b2ebb41b9581b35b19248cbaac7c6c58bdc2072b9731ebf40b7c01614f0dd409","observation_id":"77763261-4a47-45ef-9649-c75242a0fcfd","resolution":{"observed_at":"2026-08-06T18:09:17.702378Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:17.258548Z","title":null,"venue":null,"work_id":"2ea33fbd-68eb-4a43-afd8-5971dd496e1e","year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.188949Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:c39ffbcaa0841ba0ba0c62abec7dca79fbf13497b58b9f89c13fe08a8054b407","observation_id":"b9cdab9e-ee62-4e64-9360-73cb48a118f1","resolution":{"observed_at":"2026-08-06T18:09:17.390816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01920","last_updated":"2024-06-04T03:04:21Z","snapshot_observed_at":"2026-08-06T20:49:37.611347Z","submitted_at":"2024-06-04T03:04:21Z","title":"CODE: Contrasting Self-generated Description to Combat Hallucination in Large Multi-modal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01920","snapshot_observed_at":"2026-08-06T18:09:06.273983Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.273983Z"},"links":{"cited_paper":"/paper/2406.01920","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:18fc3a0e478e5afa29a9af5537206d35c06f7284c5dd06c665770290346f5691","observation_id":"0dc191f6-aee6-4e7c-ad82-537c18805271","resolution":{"observed_at":"2026-08-06T18:09:06.273983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:16.968070Z","title":null,"venue":null,"work_id":"5f4cabb3-cf4b-4842-9c06-0caaceba56a1","year":null},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.323073Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:5871f91bb59a790e91cebe9fcdebeb3b2a4a1c973caef14888e4fee5516d8490","observation_id":"aa3e0550-26c3-415f-88d2-2392ee3c70e6","resolution":{"observed_at":"2026-08-06T18:09:17.132638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12787","last_updated":"2024-10-16T17:59:02Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-16T17:59:02Z","title":"The Curse of Multi-Modalities: Evaluating Hallucinations of Large Multimodal Models across Language, Visual, and Audio","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12787","snapshot_observed_at":"2026-08-06T18:09:06.449230Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.449230Z"},"links":{"cited_paper":"/paper/2410.12787","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:9dc624d9a1996ae1e821f607bbdc0d2737c15724cd9d5cf6120cd2c184e3c7d4","observation_id":"70a1b00b-d496-44ea-9da8-771c397e9079","resolution":{"observed_at":"2026-08-06T18:09:06.449230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:16.756389Z","title":null,"venue":null,"work_id":"92490a24-8f25-4eae-98a8-3cd9c2c61913","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.501121Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:0bc5cb0abf9f3a3c6353add3bc8066891241015d571045c0de6edf33c7f19173","observation_id":"9764b61f-828a-414f-8da2-ec9aec90b5ce","resolution":{"observed_at":"2026-08-06T18:09:16.874266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-06T18:09:06.591569Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.591569Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:cbf18f2ddb79d0b14fa2e93258a234bf37db16e1cbd73a9c477cf62905ed5e7d","observation_id":"88b7641a-c56a-4f69-b097-04f47aa6c712","resolution":{"observed_at":"2026-08-06T18:09:06.591569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:06.686333Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.686333Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:efa2800fc75b8954fc26e9d1351e5552c1f31169c37d2439752e87605f14aaf4","observation_id":"1df0b745-14f4-4cf4-a6d0-d7a1fae2799a","resolution":{"observed_at":"2026-08-06T18:09:06.686333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:16.471212Z","title":null,"venue":null,"work_id":"e7030297-3231-4ed7-a493-6f24c0360fd7","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.758371Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:87f0bbaf05e008aa03b99e4907d46d79e2095e66495087471ab6b66e6e09677a","observation_id":"c1e0ca83-a3fe-4905-b7e4-168adc7056c0","resolution":{"observed_at":"2026-08-06T18:09:16.624255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:06.971934Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.971934Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:9ac4bf072969fa4c11835353dc48ad5f948ed6a6f94f231fe4333c379abd130d","observation_id":"d45520d9-3a23-470f-9eee-0312447d6314","resolution":{"observed_at":"2026-08-06T18:09:06.971934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-04T20:12:13.512069Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-08-06T18:09:07.147109Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.147109Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:2f497cc5c6be77fe05d4ffb1fc40eb657d575956cb34a6508b9b9192fb5efa0f","observation_id":"e6114f00-c053-4fb8-a6a2-cc4b806b3095","resolution":{"observed_at":"2026-08-06T18:09:07.147109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:07.253341Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.253341Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:e46e3ec9d585076683e42b214d73e12615cd71b774b94119470569413b8a1f37","observation_id":"15a496be-60bd-48ad-a501-ff16e96edf96","resolution":{"observed_at":"2026-08-06T18:09:07.253341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:15.797261Z","title":null,"venue":null,"work_id":"daf25050-ce58-4c26-a9c1-0dfef6b0765e","year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.380701Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:ea870dd9bfc4495f5f1fc2cc3a80e784a3fedf278cd6bc37304424bd6624e834","observation_id":"d22cc338-58f2-4c13-93e4-a2e1e6922cd1","resolution":{"observed_at":"2026-08-06T18:09:15.978006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-06T18:09:07.054223Z","title":"arXiv preprint arXiv:2305.10355 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.054223Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:a4bc813aa6a22046cfeb0ea6c15bd24930639581eafb2b07cc5d2c982749b9bd","observation_id":"0ab4622a-1c60-470b-9dd2-93f732e094b8","resolution":{"observed_at":"2026-08-06T18:09:07.054223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-06T18:09:07.643264Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.643264Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:18095d522948025f54dae773d6510b062c86f28769eec1bc5f4867f499ae9e2f","observation_id":"c22237cb-71ed-4ebe-acc6-56aebf738758","resolution":{"observed_at":"2026-08-06T18:09:07.643264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21771","last_updated":"2024-07-31T17:46:57Z","snapshot_observed_at":"2026-08-06T11:42:03.713360Z","submitted_at":"2024-07-31T17:46:57Z","title":"Paying More Attention to Image: A Training-Free Method for Alleviating Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21771","snapshot_observed_at":"2026-08-06T18:09:07.742579Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.742579Z"},"links":{"cited_paper":"/paper/2407.21771","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:9d762bf929e60f4e721e7be00df58d357c7fccaf2338df6bdcb8d48b61b3b570","observation_id":"3b609538-f8cf-4f93-b377-1b8c60848552","resolution":{"observed_at":"2026-08-06T18:09:07.742579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:16.181077Z","title":"In International Conference on Learning Representations","venue":null,"work_id":"51c9c9b3-eefc-43b2-9dd1-9476226ce899","year":null},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.322599Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:adb22396b4f4014f26d3005854bd5bca6ffaf66db1dc96b2d4134b5ccf663a3b","observation_id":"5ca435f9-032a-4d29-843a-c0c3a9a1153c","resolution":{"observed_at":"2026-08-06T18:09:16.298488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:15.157547Z","title":"Manmatha, and C","venue":null,"work_id":"84de9514-6600-4f94-8511-cdfc49ef0e98","year":2020},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.960230Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:c4638814f8e7cfcda4eeb175e7720d77e905a05c02ebdcec86f342fd8eec56ea","observation_id":"80ad7e54-f0fd-48d7-87c3-1eff52fd99a7","resolution":{"observed_at":"2026-08-06T18:09:15.330230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:15.486049Z","title":null,"venue":null,"work_id":"e7be6960-37fb-4e76-8e7b-ad2eecd91a02","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.521404Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:03ba8e0486766647c5785210bca35d713fbf00150cd768db6547652c0894bf16","observation_id":"52b92175-1d51-4f4c-bc01-48bc885c7883","resolution":{"observed_at":"2026-08-06T18:09:15.656818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:08.192571Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.192571Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:ce75075929554c12c3633681279b04212499f4719d8e628fccccd295501439d0","observation_id":"2810d02c-e4e2-47bb-9327-a334608a8bc2","resolution":{"observed_at":"2026-08-06T18:09:08.192571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-06T18:09:08.300995Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.300995Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:0be296a1323ab1ad3720ee50b80af9f5515462d58b1e058fda09488a56b16f67","observation_id":"7dbdb3e2-05ca-4815-94d6-8fbd74c153c5","resolution":{"observed_at":"2026-08-06T18:09:08.300995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:07.851036Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.851036Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:9f272674127445b361a41c25a2683134a00290aa57adc9edb42fea11b5ad3a05","observation_id":"58f3bd48-5fea-4155-8484-1777da5d3642","resolution":{"observed_at":"2026-08-06T18:09:07.851036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06795","last_updated":"2025-08-12T08:34:12Z","snapshot_observed_at":"2026-07-06T19:30:21.486298Z","submitted_at":"2024-10-09T11:46:32Z","title":"From Pixels to Tokens: Revisiting Object Hallucinations in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06795","snapshot_observed_at":"2026-08-06T18:09:08.482728Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.482728Z"},"links":{"cited_paper":"/paper/2410.06795","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:f702b841e668d0febd78a1209cb6fe67732622bd59bfc5bd1a9fda736b5574a7","observation_id":"0be4d241-e75c-4703-88ce-a467f8455973","resolution":{"observed_at":"2026-08-06T18:09:08.482728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08730","last_updated":"2024-04-03T15:22:23Z","snapshot_observed_at":"2026-07-06T17:44:04.908253Z","submitted_at":"2024-03-13T17:29:45Z","title":"Strengthening Multimodal Large Language Model with Bootstrapped Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08730","snapshot_observed_at":"2026-08-06T18:09:08.076475Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.076475Z"},"links":{"cited_paper":"/paper/2403.08730","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:5f2f5eeade7fb120e25a2243bf16bbff5a058dfbf02440bb31dbbd1f6558ea52","observation_id":"52c4fc3e-02e6-4033-b8c7-0c0d6f315399","resolution":{"observed_at":"2026-08-06T18:09:08.076475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-06T18:09:08.726538Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.726538Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:127e97a22d55779bc75cc469400982fffe73c841ceefe2af065dd2080f2e1ab8","observation_id":"46cbb77a-34e6-45ec-b9bd-15175cad2bd5","resolution":{"observed_at":"2026-08-06T18:09:08.726538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-06T18:09:08.807559Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.807559Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:00cfe6b40aa0500bcf16d1c561c3bc1c7ae05541f00c98bff2e2be546f04300a","observation_id":"81d4d4e1-1162-4346-a292-b8fbfa279aff","resolution":{"observed_at":"2026-08-06T18:09:08.807559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:15.062353Z","title":"Arik, and Tomas Pfister","venue":null,"work_id":"cf090454-3042-4442-8938-98fbf3a7473f","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.400129Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:d5b8913ae54daec36a0ea9799975f04727cec5cde674628aba2d7263419ba0b3","observation_id":"8d5ac4f5-b40c-4fb3-b26e-f100904242b6","resolution":{"observed_at":"2026-08-06T18:09:15.087353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.682866Z","title":null,"venue":null,"work_id":"1d97eeb5-52c4-4987-afea-808f3dd4473f","year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.034768Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:0d8c3f84f6c31e8da1138ecd3d4ab2085fddc8ba04c2c5d2ae54384ed1840e67","observation_id":"0f577e07-8c5a-48e4-9a26-cdaf27b5fe6a","resolution":{"observed_at":"2026-08-06T18:09:14.719597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.935745Z","title":null,"venue":null,"work_id":"d9f5cfac-2c49-4d53-864e-c47643455654","year":2019},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.610437Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:becb09dea77bb2bbfae4ed0cc4ad47c7b9716150a9021fbf5be7e194264e0d58","observation_id":"ae9153c9-cc38-442a-b259-fb01284dfca1","resolution":{"observed_at":"2026-08-06T18:09:15.025340Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T18:09:09.204371Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.204371Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:97f8225d0f25dfad2a8a61554f7150d8d846edde673a0f4c495eab835baa7547","observation_id":"e4ab56b1-8127-4d9d-afa9-a99611ef65a5","resolution":{"observed_at":"2026-08-06T18:09:09.204371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.461420Z","title":"Shazeer, Niki Parmar, Jakob Uszkoreit, Llion Jones, Aidan N","venue":null,"work_id":"42dcf718-8b1f-49da-abe0-12f650ed2396","year":2017},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.275068Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:21041cca3faae66141e9aef35e26186c9c8eaca9565afb0952ff88b6581e2e26","observation_id":"af9ed801-5e99-4573-ab8d-052c41e5cd48","resolution":{"observed_at":"2026-08-06T18:09:14.514762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.774183Z","title":null,"venue":null,"work_id":"9815e5df-c9e8-4f76-9779-5d6ffabeb3a2","year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.943756Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:8e4cd0dbc3ab925c9a1154aa013ac1ecc64b2427be3f53170571ea0e7ce7cd15","observation_id":"d1961a3a-0f36-41fb-a516-09781e85eecd","resolution":{"observed_at":"2026-08-06T18:09:14.869493Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15839","last_updated":"2025-03-15T12:22:18Z","snapshot_observed_at":"2026-07-06T19:56:08.504922Z","submitted_at":"2024-11-24T13:42:02Z","title":"VaLiD: Mitigating the Hallucination of Large Vision Language Models by Visual Layer Fusion Contrastive Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15839","snapshot_observed_at":"2026-08-06T18:09:09.645932Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.645932Z"},"links":{"cited_paper":"/paper/2411.15839","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:9ab3874f6ffc2af0b1908cebbc1b32b93e566eb554464d2c0eee6e66e4381e60","observation_id":"a17ce182-7c35-4914-8e42-e257f91fb604","resolution":{"observed_at":"2026-08-06T18:09:09.645932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.561395Z","title":null,"venue":null,"work_id":"da6706a4-a8f7-4555-a129-d932219e8c74","year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.122298Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:25e24b3bad9a7f7cc550c9dcb7b6bd587db3dca53b69b8ee34bce7556218d973","observation_id":"2a700b16-c4c3-459e-b125-83428ddbfdda","resolution":{"observed_at":"2026-08-06T18:09:14.626533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14160","last_updated":"2023-12-19T15:13:52Z","snapshot_observed_at":"2026-08-04T17:03:48.643939Z","submitted_at":"2023-05-23T15:26:20Z","title":"Label Words are Anchors: An Information Flow Perspective for Understanding In-Context Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14160","snapshot_observed_at":"2026-08-06T18:09:09.900466Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.900466Z"},"links":{"cited_paper":"/paper/2305.14160","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:43074747fa600a84bd5361e57be2a030325b6a63466e1c004af7076163577c5f","observation_id":"c396b57c-ee72-4e57-83bf-541e749a2636","resolution":{"observed_at":"2026-08-06T18:09:09.900466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T18:09:10.031074Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.031074Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:10ee267a636b3e9415bc9dbd97f2335274d5d20836b63dc4343d2cf9dc1715d8","observation_id":"a334d24c-4646-4bc9-894e-1a9fc7635546","resolution":{"observed_at":"2026-08-06T18:09:10.031074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11839","last_updated":"2024-10-07T17:59:42Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:59:58Z","title":"mDPO: Conditional Preference Optimization for Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11839","snapshot_observed_at":"2026-08-06T18:09:09.378681Z","title":"Huang, Nan Xu, Sheng Zhang, Hoifung Poon, and Muhao Chen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.378681Z"},"links":{"cited_paper":"/paper/2406.11839","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:16d5080c68cf30db875e15bf54ed9e9f40d7eeccaa7b352667ebd8bb24012e02","observation_id":"a8db0e4d-af71-4ae6-8e6c-67244ac9b2e8","resolution":{"observed_at":"2026-08-06T18:09:09.378681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12735","last_updated":"2025-04-26T15:42:47Z","snapshot_observed_at":"2026-07-06T19:34:41.712266Z","submitted_at":"2024-10-16T16:51:01Z","title":"CREAM: Consistency Regularized Self-Rewarding Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12735","snapshot_observed_at":"2026-08-06T18:09:10.242420Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.242420Z"},"links":{"cited_paper":"/paper/2410.12735","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:1ad11b693174aa63a048b8b5c716eb1094210cecdb9dffddfdc55302b399526f","observation_id":"563b46ce-91bc-487f-8af0-ab6aeb176d77","resolution":{"observed_at":"2026-08-06T18:09:10.242420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.369773Z","title":null,"venue":null,"work_id":"94591e11-404d-43e5-8164-afd5e1f28a05","year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.817941Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:ea25e94dadae9246a0d148c0f72ead63d2ac4643efb2153c647d82e63f07d709","observation_id":"f0052603-68f4-487f-a407-945ff5ca17e6","resolution":{"observed_at":"2026-08-06T18:09:14.419804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.125872Z","title":null,"venue":null,"work_id":"1ab94c2b-d364-4d30-819c-3ca2ed536b72","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.441019Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:590b11a86413427576f7247e5f40406f6796b393e4d71c0b21b73ac42463a6fd","observation_id":"e886fdb5-cb9a-4bec-afa8-0bf0f6213364","resolution":{"observed_at":"2026-08-06T18:09:14.162248Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15926","last_updated":"2024-10-21T11:54:53Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T11:54:53Z","title":"Mitigating Object Hallucination via Concentric Causal Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15926","snapshot_observed_at":"2026-08-06T18:09:10.520717Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.520717Z"},"links":{"cited_paper":"/paper/2410.15926","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:ff9c81bfa14111f6be85ea66ed344a14600f512ca3ac7cdf052871ffaa90d48a","observation_id":"411a568b-4c58-45f2-a6ed-5323307509ea","resolution":{"observed_at":"2026-08-06T18:09:10.520717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18715","last_updated":"2024-06-05T13:53:42Z","snapshot_observed_at":"2026-07-06T17:52:00.714976Z","submitted_at":"2024-03-27T16:04:47Z","title":"Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18715","snapshot_observed_at":"2026-08-06T18:09:10.145870Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.145870Z"},"links":{"cited_paper":"/paper/2403.18715","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:640a39287668bed85d1293afd5acc33679ac79e716234c822e98a19537748f17","observation_id":"e743edde-d29a-44c7-8718-14b8c0d283f5","resolution":{"observed_at":"2026-08-06T18:09:10.145870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11903","last_updated":"2025-03-08T12:36:34Z","snapshot_observed_at":"2026-08-02T06:58:43.889267Z","submitted_at":"2025-02-17T15:24:49Z","title":"MMRC: A Large-Scale Benchmark for Understanding Multimodal Large Language Model in Real-World Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11903","snapshot_observed_at":"2026-08-06T18:09:10.674561Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.674561Z"},"links":{"cited_paper":"/paper/2502.11903","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:f86e2d68fa75b1a56042e4be73098c512e0d8740d18ef0d4bbef1cca619d4664","observation_id":"92ee96e0-4a3f-49f5-9aac-b12393d9a28f","resolution":{"observed_at":"2026-08-06T18:09:10.674561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.210905Z","title":null,"venue":null,"work_id":"56e16f58-49dc-46ae-9353-9d28d7a10b3e","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.346439Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:85e962499c4611dcc74c537a6942ec76a3481be0aff31e8bc92db34a9bb43f19","observation_id":"07cbe223-db0a-407a-a553-d73414818924","resolution":{"observed_at":"2026-08-06T18:09:14.297573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:13.885572Z","title":null,"venue":null,"work_id":"fa5e1c5f-5cbb-47c9-9e8e-4615e2e332f3","year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.916123Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:24ec6572ef8ee78c3959ac92c3f4743a3647b2a041632957473f1dae94f8503e","observation_id":"6db15840-a5d1-42f6-a76d-41eece62ede4","resolution":{"observed_at":"2026-08-06T18:09:13.966372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-06T18:09:10.998551Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.998551Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:73a1b0d0c3afde42b7442a2a18e5d1e666b13ff8c16bf237b71beddea36fe91f","observation_id":"46bbd451-a378-441c-ad19-406afd5b816f","resolution":{"observed_at":"2026-08-06T18:09:10.998551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02712","last_updated":"2025-03-04T00:49:07Z","snapshot_observed_at":"2026-08-06T04:32:16.849942Z","submitted_at":"2024-10-03T17:36:33Z","title":"LLaVA-Critic: Learning to Evaluate Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02712","snapshot_observed_at":"2026-08-06T18:09:10.589173Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.589173Z"},"links":{"cited_paper":"/paper/2410.02712","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:1d444b58e9ea0c4de7f14d7c3ad4ad50c36bf0fded6e23407d2168524ef15af2","observation_id":"708e58dd-3871-433a-9b07-054563273b3e","resolution":{"observed_at":"2026-08-06T18:09:10.589173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00849","last_updated":"2024-03-08T06:42:37Z","snapshot_observed_at":"2026-07-06T16:55:49.813116Z","submitted_at":"2023-12-01T11:36:08Z","title":"RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-grained Correctional Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00849","snapshot_observed_at":"2026-08-06T18:09:11.211296Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.211296Z"},"links":{"cited_paper":"/paper/2312.00849","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:1fc471e65b7f2c962f2c6556a121460197e736a3d969f3a172cf4f5291ecef84","observation_id":"8f808cba-a471-4b70-aeb0-656436b2e9a7","resolution":{"observed_at":"2026-08-06T18:09:11.211296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.045818Z","title":null,"venue":null,"work_id":"ddcd499a-69cf-43e1-a4a5-9da7f63d641c","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.776242Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:f8377d678395f0d6efcf5933e21be3d38077f2d911087d6d10bce88883e3b8a6","observation_id":"0cd6c351-2d75-417f-9eb7-e788722dfcf6","resolution":{"observed_at":"2026-08-06T18:09:14.091155Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-07-06T18:35:22.425271Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-06T18:09:11.418491Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.418491Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:4f11b1d519272fcbe5df675f3a931f9494658e226124f76fd1d07badf176e37b","observation_id":"3b3b67f3-291b-40f7-8796-9667f427ba3a","resolution":{"observed_at":"2026-08-06T18:09:11.418491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:13.638751Z","title":null,"venue":null,"work_id":"125ca6cc-7f46-42b9-a028-141e1710418d","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.498499Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:78f65b5f2d45deeed2d0ca815c3ec2af566289c8636022806c663f0452bddb0d","observation_id":"3046f952-ebd4-44c8-af68-99b8cccb82e1","resolution":{"observed_at":"2026-08-06T18:09:13.685418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:13.744791Z","title":null,"venue":null,"work_id":"1f197515-bff7-4bdc-98e8-048b56731818","year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.065192Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:598377b90188651a3fb4a9f187af2da2d6acedd8007b307cbfab312638056f7d","observation_id":"89422fe3-b9c0-462c-bec1-f882dab904e5","resolution":{"observed_at":"2026-08-06T18:09:13.809146Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11422","last_updated":"2024-07-16T06:32:45Z","snapshot_observed_at":"2026-07-06T18:46:56.695142Z","submitted_at":"2024-07-16T06:32:45Z","title":"Reflective Instruction Tuning: Mitigating Hallucinations in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2407.11422","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.11422","snapshot_observed_at":"2026-08-06T18:09:13.002512Z","title":"Reflective Instruction Tuning: Mitigating Hallucinations in Large Vision-Language Models","venue":"cs.CV","work_id":"173c99af-6646-467a-9554-1e1d43e52ac4","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.719079Z"},"links":{"cited_paper":"/paper/2407.11422","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:16405da28d040cd44300b70cddebf00d2e3b68cc66abd4494dad5f6db00ee52b","observation_id":"1e66cf87-d599-48a7-921d-7210abbedea0","resolution":{"observed_at":"2026-08-06T18:09:13.037301Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-06T13:03:19.727877Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-06T18:09:11.337073Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.337073Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:a2e22a514a70164f74e5bf6b0b7a01fcf9b0f89d1aaebd0541d5ef37211bb572","observation_id":"30459bec-247f-4e65-bbad-a03dc65153d9","resolution":{"observed_at":"2026-08-06T18:09:11.337073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-07T09:15:02.322742Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-06T18:09:11.917632Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.917632Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:c95fbd96a0a3840677062effec4a4047f71d2c6977a3051eec57cd852c08348c","observation_id":"d01f3afc-539a-41da-ae2a-b9f69b3bb80b","resolution":{"observed_at":"2026-08-06T18:09:11.917632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06579","last_updated":"2024-10-17T01:17:25Z","snapshot_observed_at":"2026-07-06T18:28:20.634381Z","submitted_at":"2024-06-04T13:52:54Z","title":"From Redundancy to Relevance: Information Flow in LVLMs Across Reasoning Tasks","version":3},"cited_work":{"arxiv_id":"2406.06579","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06579","snapshot_observed_at":"2026-08-06T18:09:12.902725Z","title":"From Redundancy to Relevance: Information Flow in LVLMs Across Reasoning Tasks","venue":"cs.CL","work_id":"dc5f0ca8-ca7c-47a3-a484-cbd37d9f82b4","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.046604Z"},"links":{"cited_paper":"/paper/2406.06579","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:47a63d6162f524c17af23f62d231960664e50ff96c4f1d3807f7cdc30adf3606","observation_id":"dd20abaf-9c03-42fb-8614-74593012eb15","resolution":{"observed_at":"2026-08-06T18:09:12.932697Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02858","last_updated":"2023-10-25T06:23:31Z","snapshot_observed_at":"2026-07-06T15:38:39.712379Z","submitted_at":"2023-06-05T13:17:27Z","title":"Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02858","snapshot_observed_at":"2026-08-06T18:09:11.588609Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.588609Z"},"links":{"cited_paper":"/paper/2306.02858","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:794ba4e9ecce92f1f70e3512312b679c527cba99c468aa5a663bbf059ae7b2d5","observation_id":"53e7fa6d-e143-4f36-aa72-3690680403f5","resolution":{"observed_at":"2026-08-06T18:09:11.588609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:13.400633Z","title":null,"venue":null,"work_id":"67e5490d-ed27-4bc4-9bd1-401b9a41b0e2","year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.225814Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:7197b60263f54e1fdfc360e2574db3c0991e0ec431d2ef03ef446645a9abd426","observation_id":"76c7d8a6-a913-4400-8967-34ebb786dca1","resolution":{"observed_at":"2026-08-06T18:09:13.449450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03601","last_updated":"2025-06-12T00:15:18Z","snapshot_observed_at":"2026-08-06T08:24:07.376776Z","submitted_at":"2023-07-07T13:43:44Z","title":"GPT4RoI: Instruction Tuning Large Language Model on Region-of-Interest","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03601","snapshot_observed_at":"2026-08-06T18:09:11.814271Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.814271Z"},"links":{"cited_paper":"/paper/2307.03601","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:356dd03979bc308b322f22774e9334c8909b02bc62a7120f6aef154c2ddc3428","observation_id":"51643b6c-c484-4f9e-8a29-d8079c653794","resolution":{"observed_at":"2026-08-06T18:09:11.814271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14622","last_updated":"2024-11-02T02:51:51Z","snapshot_observed_at":"2026-07-30T21:22:18.339303Z","submitted_at":"2024-05-23T14:30:33Z","title":"Calibrated Self-Rewarding Vision Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14622","snapshot_observed_at":"2026-08-06T18:09:12.392099Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.392099Z"},"links":{"cited_paper":"/paper/2405.14622","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:e74819856ec2a7b19bfe248d935abe8b4fef0581d1f8c8b1f0c61ddb61f6fa84","observation_id":"b6aaca34-97a0-4a9e-a37e-973914438421","resolution":{"observed_at":"2026-08-06T18:09:12.392099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T18:09:12.489350Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.489350Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:daab416edfb13202623f74d06db13ff6f97b0307409baa820e6f6b325141581d","observation_id":"bf184da4-4f7d-41da-86fc-545c081ffa3d","resolution":{"observed_at":"2026-08-06T18:09:12.489350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:13.526225Z","title":null,"venue":null,"work_id":"571d7932-0d62-471e-bbf1-0e81c69367a5","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.143697Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:500e46da401ad5e89efa660168efa00a17732d620d2300d4e70ee078cfba0e1c","observation_id":"11926a68-755d-45a7-86f0-458ee677f19f","resolution":{"observed_at":"2026-08-06T18:09:13.565406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-05T12:32:26.990966Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-06T18:09:12.654015Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.654015Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:dccdf74f5e42a6ab2d874fadc40581e69eea613884cf38c0735016eba72bd6a0","observation_id":"6cf7bf70-5853-428f-80e8-95f8bf768da5","resolution":{"observed_at":"2026-08-06T18:09:12.654015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-08-06T18:09:12.304104Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.304104Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:6b16dd14ab1979434b11751e2d9efc2a509184316fb0f13e15943dd8c0f4bc92","observation_id":"5536d1b1-88aa-4703-8df5-96e920f57a79","resolution":{"observed_at":"2026-08-06T18:09:12.304104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18476","last_updated":"2024-02-28T16:57:22Z","snapshot_observed_at":"2026-07-06T17:36:56.979448Z","submitted_at":"2024-02-28T16:57:22Z","title":"IBD: Alleviating Hallucinations in Large Vision-Language Models via Image-Biased Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18476","snapshot_observed_at":"2026-08-06T18:09:12.583205Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.583205Z"},"links":{"cited_paper":"/paper/2402.18476","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:881c0bef72bbbc28e4ad4f5a8d3cfb329a2bacae35b30bb01d55e91707a28904","observation_id":"edae4f2c-96c7-4d3d-9a0a-0d0d4ee61267","resolution":{"observed_at":"2026-08-06T18:09:12.583205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:12.703445Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.703445Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:be3bd780fb9e6262c2c63824c553b03ccdb7abf47dd99770a145fb02d6438e42","observation_id":"e3f35456-f795-4df4-b3f2-3947d9e951fd","resolution":{"observed_at":"2026-08-06T18:09:12.703445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.239502Z","title":"International Journal of Computer Vision 127 (2016), 398 – 414","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.239502Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:132f5d6f5a9f3ea3f17b0ff5d275c1153b6afa94e7fd8de186d3517757de69c8","observation_id":"ad44aed1-9d8f-4444-96f7-7175fad57f12","resolution":{"observed_at":"2026-08-06T18:09:05.239502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05337","last_updated":"2024-07-26T15:49:31Z","snapshot_observed_at":"2026-08-06T10:05:02.925573Z","submitted_at":"2024-07-26T15:49:31Z","title":"VACoDe: Visual Augmented Contrastive Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05337","snapshot_observed_at":"2026-08-06T18:09:06.394893Z","title":"ArXiv abs/2408.05337 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.394893Z"},"links":{"cited_paper":"/paper/2408.05337","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:94ac8ba0c7c02c21efa37308e40184e533be5fcf5227e744256da3399a923dcd","observation_id":"f69c65f3-fa10-4de4-b0a9-bfaeec53e372","resolution":{"observed_at":"2026-08-06T18:09:06.394893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T09:15:22.263434Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models"},"reference_resolution":{"displayed":92,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":86,"verified_exact":2,"verified_fuzzy":4},"total_outbound_references":92},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 92 of 92 outbound references and 2 inbound Pith citation observations for arXiv:2507.09184."}