{"as_of":"2026-08-07T23:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a2b1de5363b6dc1fa43487d0ee795b2b80bdbb35ad0eb20c10345912dbf07095","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:34:56.649817Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T01:49:15.136031Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T16:01:22.762740Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"cited_work":{"arxiv_id":"2506.17664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17664","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"620f5884-4112-4152-90e4-9f22404d694a","year":2025},"citing_paper":{"arxiv_id":"2605.00814","last_updated":"2026-05-08T16:52:48Z","snapshot_observed_at":"2026-07-06T23:14:11.211164Z","submitted_at":"2026-05-01T17:54:37Z","title":"Persistent Visual Memory: Sustaining Perception for Deep Generation in LVLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-09T18:53:06.494640Z"},"links":{"cited_paper":"/paper/2506.17664","citing_paper":"/paper/2605.00814"},"observation_digest":"sha256:5fdb811ee6b5bb9224b41cd837aaf6262c67a746208615b57d3e6d5ac2f53536","observation_id":"a6efc5ab-82e8-46db-9ee7-616d25da5476","resolution":{"observed_at":"2026-05-11T16:01:22.777348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"cited_work":{"arxiv_id":"2506.17664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17664","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"620f5884-4112-4152-90e4-9f22404d694a","year":2025},"citing_paper":{"arxiv_id":"2605.00814","last_updated":"2026-05-08T16:52:48Z","snapshot_observed_at":"2026-07-06T23:14:11.211164Z","submitted_at":"2026-05-01T17:54:37Z","title":"Persistent Visual Memory: Sustaining Perception for Deep Generation in LVLMs","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-11T01:49:15.136031Z"},"links":{"cited_paper":"/paper/2506.17664","citing_paper":"/paper/2605.00814"},"observation_digest":"sha256:aea7f56ca2df39145a9593ac11a1f13fed8791ff6021a10034953c4433c4b532","observation_id":"c1436332-d86a-4610-9ff0-277a199108ba","resolution":{"observed_at":"2026-05-11T01:50:51.532867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.17664/citation-record","integrity":"/paper/2506.17664/integrity","json":"/paper/2506.17664/citation-record.json","paper":"/paper/2506.17664"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-06T23:34:55.081734Z","title":"Shikra: Unleash- ing multimodal llm’s referential dialogue magic","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.081734Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:b5cbbeaade57030955d6bc65c16e1e52e590d4ae8f1754f99c76af3371f22a2f","observation_id":"a01c9e40-12ba-4f38-aed7-c5675210c69f","resolution":{"observed_at":"2026-08-06T23:34:55.081734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15300","last_updated":"2024-04-23T09:32:25Z","snapshot_observed_at":"2026-07-06T17:34:32.617468Z","submitted_at":"2024-02-23T12:57:16Z","title":"Seeing is Believing: Mitigating Hallucination in Large Vision-Language Models via CLIP-Guided Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15300","snapshot_observed_at":"2026-08-06T23:34:55.164743Z","title":"arXiv preprint arXiv:2402.15300","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.164743Z"},"links":{"cited_paper":"/paper/2402.15300","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:aa3341ac0c0264d48caa04b41fde0e485c1ff4bd964b6340b0ae7d0a64245239","observation_id":"5381a6ff-955e-46b2-a247-d81895bd4159","resolution":{"observed_at":"2026-08-06T23:34:55.164743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-06T23:34:55.278265Z","title":"URL:https://arxiv.org/abs/2306.13394, arXiv:2306.13394","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.278265Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:3f4bb2d20ac015eabb9f06527d15c37bb33bb5a2053c2cf4f55fd971389a1b15","observation_id":"3acb9a3f-0ac5-4fc1-9016-dfa90bb4677d","resolution":{"observed_at":"2026-08-06T23:34:55.278265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T23:34:55.465653Z","title":"arXiv preprint arXiv:2410.21276","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.465653Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:aec7c7ee6af99002e42540506868e753e7597b36bab71051d9fa80ccc28823f8","observation_id":"8b2b0a8f-af0a-4306-ae4a-dd4706c9bad8","resolution":{"observed_at":"2026-08-06T23:34:55.465653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18814","last_updated":"2024-03-27T17:59:04Z","snapshot_observed_at":"2026-07-31T05:41:28.385099Z","submitted_at":"2024-03-27T17:59:04Z","title":"Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18814","snapshot_observed_at":"2026-08-06T23:34:55.674752Z","title":"arXiv preprint arXiv:2403.18814","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.674752Z"},"links":{"cited_paper":"/paper/2403.18814","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:00ca1d80727d7a134477bec30550faac6b75f9b7002e8c5eb903ae421a225b66","observation_id":"58ef4792-b290-4307-9c93-f8f8618fade0","resolution":{"observed_at":"2026-08-06T23:34:55.674752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-05T16:51:32.094151Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-06T23:34:55.735935Z","title":"arXiv preprint arXiv:2403.05525","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.735935Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:02e971ad3f3cc8fcf62a9f8b7abd394987cfc50c004ee526c6f6cb9150ecb8b1","observation_id":"f5974394-d72d-41d7-8774-134f78e52d20","resolution":{"observed_at":"2026-08-06T23:34:55.735935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-06T23:34:55.885669Z","title":"arXiv preprint arXiv:2309.14525","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.885669Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:2e762cc7e72162c71692afe04d637a50e4d06963462f4fc299590082b8a5b01f","observation_id":"6876b6ee-b62b-4f54-bc7e-060ab3694c6a","resolution":{"observed_at":"2026-08-06T23:34:55.885669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T23:34:55.934743Z","title":"arXiv preprint arXiv:2312.11805","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.934743Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:050f2c400cdf1c9ab50663262d3eb2a6aa3ec06f8e80e20ad14062a504f8ac7f","observation_id":"b08c0987-0469-4868-ad41-5cf26c981d82","resolution":{"observed_at":"2026-08-06T23:34:55.934743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T23:34:55.992900Z","title":"arXiv preprint arXiv:2409.12191","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.992900Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:24766cb85eaa1014a8ff8c0f15e22e7c6cfeece71c7b1c398553c11282b41f34","observation_id":"b6bd49ea-46fc-4c65-836e-cf82d369b442","resolution":{"observed_at":"2026-08-06T23:34:55.992900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02677","last_updated":"2023-07-06T13:47:21Z","snapshot_observed_at":"2026-07-06T15:23:10.114682Z","submitted_at":"2023-05-04T09:48:22Z","title":"Caption Anything: Interactive Image Description with Diverse Multimodal Controls","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02677","snapshot_observed_at":"2026-08-06T23:34:56.110735Z","title":"arXiv preprint arXiv:2305.02677","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:56.110735Z"},"links":{"cited_paper":"/paper/2305.02677","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:b0785d8eb87c6a632a94073379ae9b6b10f47e4bc6c30293b9b731fce0bc407b","observation_id":"ded3c166-299f-491a-8d8a-cf7f8be290b8","resolution":{"observed_at":"2026-08-06T23:34:56.110735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-06T23:34:56.275773Z","title":"arXiv preprint arXiv:2412.10302","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:56.275773Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:3d16e184f5c14d8a6a2915f9e28252714aa6d884f39f8e5022c56915cecdebc6","observation_id":"0bdd5568-3306-4e1c-9e9b-31e075c5403e","resolution":{"observed_at":"2026-08-06T23:34:56.275773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-06T23:34:56.417716Z","title":"arXiv preprint arXiv:2304.14178","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:56.417716Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:ceac1c699d12bfbd86bd98169811008bad576741efc697555a3084b680b04302","observation_id":"abe0cc92-da89-4367-a161-33631ac7882e","resolution":{"observed_at":"2026-08-06T23:34:56.417716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16839","last_updated":"2024-02-06T16:43:31Z","snapshot_observed_at":"2026-07-06T16:53:51.485946Z","submitted_at":"2023-11-28T14:54:37Z","title":"Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16839","snapshot_observed_at":"2026-08-06T23:34:56.541827Z","title":"arXiv preprint arXiv:2311.16839","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:56.541827Z"},"links":{"cited_paper":"/paper/2311.16839","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:ab1ee50a01d9fbc464cdf1fb6e5a9a7d40f48fde6bbae33127a6a7ab42926395","observation_id":"a95efcf4-84f7-4b69-8af0-693b4a982f1e","resolution":{"observed_at":"2026-08-06T23:34:56.541827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T23:34:56.649817Z","title":"arXiv preprint arXiv:2304.10592","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:56.649817Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:28b6afbb758ece6f562528f68cec02be5791a8ca617c8e42c7a82f654ffe824a","observation_id":"921ef3b2-bdf5-4337-85df-c2d8e04ff6f1","resolution":{"observed_at":"2026-08-06T23:34:56.649817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-06T23:34:55.813461Z","title":"arXiv preprint arXiv:1809.02156","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.813461Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:01f39a27df9ac666cf39916a2956b1a962b8ae61ca69219d85be6cd6d573fc06","observation_id":"39332d3d-a380-49ed-9974-bd42dc128f82","resolution":{"observed_at":"2026-08-06T23:34:55.813461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.03557","last_updated":"2019-08-09T17:57:13Z","snapshot_observed_at":"2026-08-07T01:39:40.489262Z","submitted_at":"2019-08-09T17:57:13Z","title":"VisualBERT: A Simple and Performant Baseline for Vision and Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.03557","snapshot_observed_at":"2026-08-06T23:34:55.544749Z","title":"arXiv preprint arXiv:1908.03557","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.544749Z"},"links":{"cited_paper":"/paper/1908.03557","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:e2ceee8558036d3a4d59d19c071f0532d42d915e0a0d332cfa37711b5e0703b4","observation_id":"751df6f5-9b7c-486d-b97a-77f3358bb160","resolution":{"observed_at":"2026-08-06T23:34:55.544749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04790","last_updated":"2023-06-13T13:31:12Z","snapshot_observed_at":"2026-07-06T15:24:38.226044Z","submitted_at":"2023-05-08T15:45:42Z","title":"MultiModal-GPT: A Vision and Language Model for Dialogue with Humans","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04790","snapshot_observed_at":"2026-08-06T23:34:55.367724Z","title":"arXiv preprint arXiv:2305.04790","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.367724Z"},"links":{"cited_paper":"/paper/2305.04790","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:531d3ec223b577c44c798e1f9b363b3dabd5c1baf7f9a207557120f7fe67c1eb","observation_id":"400765dc-0cac-40bc-a2aa-1021cce2aab4","resolution":{"observed_at":"2026-08-06T23:34:55.367724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12718","last_updated":"2025-03-14T04:38:44Z","snapshot_observed_at":"2026-07-06T18:33:02.286642Z","submitted_at":"2024-06-18T15:38:41Z","title":"Mitigating Object Hallucinations in Large Vision-Language Models with Assembly of Global and Local Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12718","snapshot_observed_at":"2026-08-06T23:34:54.937267Z","title":"arXiv preprint arXiv:2406.12718","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:54.937267Z"},"links":{"cited_paper":"/paper/2406.12718","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:fe635cc38158674048a159614c6356a1dedbbe88f6394eec6e91782e1e5c5918","observation_id":"629c7d3e-52de-4b5f-9070-f98089e618c2","resolution":{"observed_at":"2026-08-06T23:34:54.937267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T08:51:20.339828Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 2 inbound Pith citation observations for arXiv:2506.17664."}