{"as_of":"2026-08-19T08:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4d5a26829606f9e9c9e58a4644129a9e1e699218d3d0efcdc3aaa6388c78af53","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:33:05.345013Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T06:41:59.641410Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T06:46:37.512830Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"cited_work":{"arxiv_id":"2504.20468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.20468","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1a0edd07-1eee-45ad-8e4b-6f5506a8e872","year":2025},"citing_paper":{"arxiv_id":"2604.17375","last_updated":"2026-04-19T10:58:40Z","snapshot_observed_at":"2026-08-11T04:14:27.111708Z","submitted_at":"2026-04-19T10:58:40Z","title":"When Text Hijacks Vision: Benchmarking and Mitigating Text Overlay-Induced Hallucination in Vision Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T06:41:59.641410Z"},"links":{"cited_paper":"/paper/2504.20468","citing_paper":"/paper/2604.17375"},"observation_digest":"sha256:dc44cfa8c1c3fa019cf087a4c4fa48ca0c3a9e364e2a7a804d183e9b4489e248","observation_id":"29629cb6-bc1b-4997-b951-261d3053ae57","resolution":{"observed_at":"2026-05-10T06:46:37.514043Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.20468/citation-record","integrity":"/paper/2504.20468/integrity","json":"/paper/2504.20468/citation-record.json","paper":"/paper/2504.20468"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-16T05:33:04.973486Z","title":"Phi-3 technical report: A highly capable language model locally on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:04.973486Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:101d4fa9752a5b0a67bf12913ef9c5f3aaad80384224c266bc229d7380b7ce61","observation_id":"f74fe1c5-afc0-44df-b04b-2d83b2218500","resolution":{"observed_at":"2026-08-16T05:33:04.973486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T05:33:04.979571Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:04.979571Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:9ae641fe9cd7b7bf1ab43403875d0de796c5fc0d6612cccf2c1c2841b1d3862d","observation_id":"83d5ab26-c756-45fe-95e8-f5543279ecf2","resolution":{"observed_at":"2026-08-16T05:33:04.979571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.252072Z","title":"Claude 3.5 sonnet model card adden- dum","venue":null,"work_id":"c3e0e0b2-19c3-4a96-b55c-f9195782607d","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:04.984648Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:76a5bcd796e7439d8ea12528ef7125bf5d6dbff7d995949fdca1fa644a180d49","observation_id":"7401bee4-6b9c-42e4-ad70-22646d7e5df7","resolution":{"observed_at":"2026-08-16T05:33:06.258593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03216","last_updated":"2025-12-12T11:26:32Z","snapshot_observed_at":"2026-08-17T15:25:09.479397Z","submitted_at":"2024-02-05T17:26:49Z","title":"M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03216","snapshot_observed_at":"2026-08-16T05:33:04.989465Z","title":"Bge m3-embedding: Multi- lingual, multi-functionality, multi-granularity text embed- dings through self-knowledge distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:04.989465Z"},"links":{"cited_paper":"/paper/2402.03216","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:05fdc66cb5ef168ae6b4dcc7d7a4a5ac577b5119d8b53719036d49bee0bb2037","observation_id":"86f4b135-64ef-41b1-8111-aeec0f920f0c","resolution":{"observed_at":"2026-08-16T05:33:04.989465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.227930Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":"7b4393e7-c33e-4693-a34b-aeaffee8b511","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:04.994564Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:5e035b5217c74ba4691aad493ba8d1215cd49d87cdaf20c0aae2792dfb57e836","observation_id":"6756bd0e-254c-4793-bdc6-c8c6c3e9c854","resolution":{"observed_at":"2026-08-16T05:33:06.237791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.000352Z","title":"Instructblip: Towards general- purpose vision-language models with instruction tuning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.000352Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:535113ef04575735f86e1e8071d452c25f3d6c48cd6bc8d1f6cd94a01aadf537","observation_id":"fedec3f3-83b3-4eb0-bf96-66e21d772863","resolution":{"observed_at":"2026-08-16T05:33:05.000352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.004793Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.004793Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:f2fa4a8f322787443a4fb734badd03d959d500573315e31fff8a719ae76ba77b","observation_id":"ef61f654-560b-49c6-bac9-15da76807eec","resolution":{"observed_at":"2026-08-16T05:33:05.004793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-14T09:56:00.692687Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-16T05:33:05.009426Z","title":"Chatglm: A family of large language models from glm-130b to glm-4 all tools","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.009426Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:392e8ee3c9e482853aa9dbf3230314a17d3ca72064a1e78b9a33c7e0a248a210","observation_id":"10323c3d-609f-4353-aeaf-3d3083b8c1c9","resolution":{"observed_at":"2026-08-16T05:33:05.009426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16500","last_updated":"2024-08-29T12:59:12Z","snapshot_observed_at":"2026-08-18T00:01:15.410179Z","submitted_at":"2024-08-29T12:59:12Z","title":"CogVLM2: Visual Language Models for Image and Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16500","snapshot_observed_at":"2026-08-16T05:33:05.014955Z","title":"Cogvlm2: Visual language mod- els for image and video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.014955Z"},"links":{"cited_paper":"/paper/2408.16500","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:b6cd4da56e59541abc7778b607c15df27720415d5fcc442b4e5d4739fb49fd05","observation_id":"fe1be5be-9b7b-434b-b338-37be4edffc2a","resolution":{"observed_at":"2026-08-16T05:33:05.014955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-16T05:33:05.135084Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.135084Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:82bdf8569ce6b8e24e854f50cef19957305c56f88f56977fe902ce1471347062","observation_id":"4d1571af-5f14-4e77-a9bf-00de90935b21","resolution":{"observed_at":"2026-08-16T05:33:05.135084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.173328Z","title":"Opera: Alleviating hallucination in multi- modal large language models via over-trust penalty and retrospection-allocation","venue":null,"work_id":"d8e582fd-9bff-4091-9d3f-8daf4f543fe9","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.140491Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:1475b3c85cfcdddca1ab459f93c204a58352911f1ae727095c78003fa905b7b1","observation_id":"eae33eae-ce0c-40eb-836e-d94817d73068","resolution":{"observed_at":"2026-08-16T05:33:06.178855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02032","last_updated":"2025-03-16T06:51:13Z","snapshot_observed_at":"2026-08-16T13:28:40.445118Z","submitted_at":"2024-08-04T13:50:17Z","title":"Self-Introspective Decoding: Alleviating Hallucinations for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02032","snapshot_observed_at":"2026-08-16T05:33:05.145229Z","title":"Self-introspective de- coding: Alleviating hallucinations for large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.145229Z"},"links":{"cited_paper":"/paper/2408.02032","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:4e63c4151435b33ab191f43c172514d357d2bb3469e64cdf6fd85c222816ba69","observation_id":"94a0be69-dbbb-4c94-b16d-a67eba80bd3d","resolution":{"observed_at":"2026-08-16T05:33:05.145229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.08942","last_updated":"2021-02-17T18:56:03Z","snapshot_observed_at":"2026-08-16T18:44:51.917570Z","submitted_at":"2021-02-17T18:56:03Z","title":"A Survey on Locality Sensitive Hashing Algorithms and their Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.08942","snapshot_observed_at":"2026-08-16T05:33:05.150783Z","title":"A survey on locality sensitive hashing algorithms and their applica- tions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.150783Z"},"links":{"cited_paper":"/paper/2102.08942","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:a063ec23577214bc24abdbffdaa7f28c69a807d40c19b17c4d38b430a2470176","observation_id":"030ac135-0bf5-4959-bbaa-739b2429b5a9","resolution":{"observed_at":"2026-08-16T05:33:05.150783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.153033Z","title":"Towards mitigating llm hallucination via self reflection","venue":null,"work_id":"5eca6e04-40f9-4c47-9abb-2b7b515a55f0","year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.156103Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:f9f8c75f65e26b90c900657621e80f90fb48b16b2794af1f1f239997a98a827e","observation_id":"0e8f358a-ab6f-4c27-aa3b-f1d9defae5c3","resolution":{"observed_at":"2026-08-16T05:33:06.159719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.125768Z","title":"Hallucination augmented contrastive learn- ing for multimodal large language model","venue":null,"work_id":"b3d24141-622c-4429-9ad6-5720f51b64bb","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.160581Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:c416920ed07167ccf37613fdca4853fd18da05a8b8f9d1a1ae30d7453685ab3a","observation_id":"8ec3ddae-d807-488d-85bb-b90caf06ea65","resolution":{"observed_at":"2026-08-16T05:33:06.130995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07362","last_updated":"2024-04-02T04:12:43Z","snapshot_observed_at":"2026-08-19T02:01:42.352429Z","submitted_at":"2023-11-13T14:26:24Z","title":"Volcano: Mitigating Multimodal Hallucination through Self-Feedback Guided Revision","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07362","snapshot_observed_at":"2026-08-16T05:33:05.164909Z","title":"V olcano: mitigating multimodal hallucina- tion through self-feedback guided revision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.164909Z"},"links":{"cited_paper":"/paper/2311.07362","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:38d5a9479f00c37ee3e8a8491e89ed674195547c474f8606d72a1f1ca90e2cec","observation_id":"771c014e-6e3a-4f89-95c7-a39d1ade5a01","resolution":{"observed_at":"2026-08-16T05:33:05.164909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.109419Z","title":"Mitigating object hal- lucinations in large vision-language models through visual contrastive decoding","venue":null,"work_id":"2f38d548-178d-44e1-a0e1-52c88a02c385","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.169947Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:765217d6e93e803c53185b6df31ba3a3b1096b8ff455999c4d4218369f2b0419","observation_id":"4d5eba18-17db-4d5a-bd67-ab6efa75a11c","resolution":{"observed_at":"2026-08-16T05:33:06.114482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-08-12T18:48:30.326248Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-16T05:33:05.174886Z","title":"Evaluating object hallucina- tion in large vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.174886Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:1f18d7834f8fca52d9b082aada88a3e9099646bb3f113e598cbe5804b3786acb","observation_id":"d05943c0-d16a-4748-a43b-b4073ced610c","resolution":{"observed_at":"2026-08-16T05:33:05.174886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-16T05:33:05.179414Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.179414Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:ac4647d6b1a5a835dde2c25eb8576a7c1320e01d91ab81f12266b668208abf65","observation_id":"e712f285-e383-4609-88ba-d00334775e5d","resolution":{"observed_at":"2026-08-16T05:33:05.179414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.184293Z","title":"Mitigating hallucination in large multi-modal models via robust instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.184293Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:9d2199133472b3da8591665a8615a1b95ba04f81f7e70804d88d41f72cd10d92","observation_id":"690f3d1d-cc6b-4b8c-b6fb-fb641d95ea2e","resolution":{"observed_at":"2026-08-16T05:33:05.184293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.189681Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.189681Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:907dc522cfed516f2e490b40e83a95e4922957c277ff43fbb9486a86c4f47f56","observation_id":"41cbf034-0290-4eaf-8db4-8234d5825153","resolution":{"observed_at":"2026-08-16T05:33:05.189681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.194559Z","title":"Llava-next: Im- proved reasoning, ocr, and world knowledge, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.194559Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:664ef41d5feacf7c70ea1b3193fe99c6e449b95f1be2c01ccef0a4468668d4d1","observation_id":"88ce785f-54b8-440d-b85b-afaab5bc5635","resolution":{"observed_at":"2026-08-16T05:33:05.194559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.051239Z","title":"Visual instruction tuning","venue":null,"work_id":"61c99aee-78e0-4d8f-8fe4-2b2972aa3c3c","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.199136Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:55377bf2d032dc34eceb1894ec9a5bfc5276a5d65c16b88fcd1815d6d24eef03","observation_id":"4737e319-5e48-4a9a-8c48-c35ebcf25a93","resolution":{"observed_at":"2026-08-16T05:33:06.056392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-16T05:33:05.204107Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.204107Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:f0ca3726a3247f91ff26428c29ca9a3183b9c9fdca8bc317e2bfd023b5d2d40c","observation_id":"475c9ee5-a16e-4dfa-9331-4fd0802519ce","resolution":{"observed_at":"2026-08-16T05:33:05.204107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06281","last_updated":"2024-08-20T03:56:03Z","snapshot_observed_at":"2026-08-17T03:48:18.599994Z","submitted_at":"2023-07-12T16:23:09Z","title":"MMBench: Is Your Multi-modal Model an All-around Player?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06281","snapshot_observed_at":"2026-08-16T05:33:05.209223Z","title":"Mmbench: Is your multi-modal model an all-around player? arXiv preprint arXiv:2307.06281, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.209223Z"},"links":{"cited_paper":"/paper/2307.06281","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:e0e60d36a734da73874ac4ca8d7c93b01f3597015308a1e4d251f6b227f72fa7","observation_id":"2d3d16c1-4a0b-43cf-b146-11772b6a4143","resolution":{"observed_at":"2026-08-16T05:33:05.209223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.214418Z","title":"Mmbench: Is your multi-modal model an all-around player? In European Conference on Computer Vision, pages 216–233","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.214418Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:ce1aba56b3ec217a357b6737a84160485af8eeb0118ec823b344b7af670a3998","observation_id":"7e7edded-d986-44fb-8aa0-8c2b50a4c02f","resolution":{"observed_at":"2026-08-16T05:33:05.214418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-11T01:38:59.827005Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-16T05:33:05.219974Z","title":"Deepseek-vl: towards real-world vision- language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.219974Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:b4e2b4157e705da3f46d17c35519ed86a25955583166933086711a761a39ebaa","observation_id":"1126ba43-9af7-49e6-bc11-6aa9acb846c8","resolution":{"observed_at":"2026-08-16T05:33:05.219974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.225152Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.225152Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:4c9a05b4955b10b05acfdfa450a93328adb6395b8c4e7a1282be9080a07625fb","observation_id":"526101fd-7373-4a8f-a926-cdd667139a14","resolution":{"observed_at":"2026-08-16T05:33:05.225152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.008198Z","title":"Hello gpt-4o","venue":null,"work_id":"5d09daa4-83fc-49a3-9b74-4df820bce6a8","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.230832Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:282714833925f2e77d9dd9d8c5661d07270730a28c2bc6a5e8b6510f89194548","observation_id":"64187fd5-d148-4def-8eed-a8451c78ea94","resolution":{"observed_at":"2026-08-16T05:33:06.013685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.235507Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.235507Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:30a36992a926bd7c12ff80658eb8af25c713615f8fa09d7f1e2f662b60795d52","observation_id":"6abdc6f4-e6c5-4a08-b184-17bc51be04c7","resolution":{"observed_at":"2026-08-16T05:33:05.235507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.972597Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"209dc6be-ae87-40a2-a98f-53e3b18abd30","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.240720Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:428ee8a1db3d807b549b631d02509c356cd02c13781fe78a5359447e5e2b4611","observation_id":"dae203b3-f86a-4dcc-a999-8d05a0b9c5f3","resolution":{"observed_at":"2026-08-16T05:33:05.978938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-16T11:34:00.114590Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-16T05:33:05.245200Z","title":"Object hallucination in image cap- tioning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.245200Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:4daea224719fdc4834e0660bdf6f09e87f3373698259977d4b361e228bfc4a19","observation_id":"d3d9adeb-91de-48c3-a655-683391fd31ec","resolution":{"observed_at":"2026-08-16T05:33:05.245200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.249827Z","title":"Scienceqa: A novel resource for question answering on scholarly articles","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.249827Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:bb92d8eba9eb3fb31e1aca3151ebca0a12d27d24454fb538443e0314fe0296b1","observation_id":"b5f53078-1a11-413d-975e-763cbc8b696f","resolution":{"observed_at":"2026-08-16T05:33:05.249827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T05:33:05.254435Z","title":"Proximal policy optimization algo- rithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.254435Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:c1f5d1f0e73873132536a982d2cbc022ef5f80e61a5bd6f64694216ee6ae49d2","observation_id":"c352b03b-526e-4333-9a1f-e73af44dff72","resolution":{"observed_at":"2026-08-16T05:33:05.254435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.941002Z","title":"Conceptual captions: A cleaned, hypernymed, im- age alt-text dataset for automatic image captioning","venue":null,"work_id":"d52a0d05-b55d-4978-bd68-5865abb42574","year":2018},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.259020Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:8f188ce6e0530ae0050d1f205c5786994477daa23ad937e177da8a4b672283da","observation_id":"3de345a3-61b9-4658-b921-f970338e013e","resolution":{"observed_at":"2026-08-16T05:33:05.946670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.920067Z","title":"Intervening anchor token: Decod- ing strategy in alleviating hallucinations for mllms","venue":null,"work_id":"22ffdd75-313c-41b6-8392-cc9ca7797050","year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.263655Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:4cc5b6a9c1729d232d0a7ccea38557e2a74c0a5906f75d0949a2e2d037f83079","observation_id":"2d6785af-aa05-4322-bf4f-79939be67186","resolution":{"observed_at":"2026-08-16T05:33:05.925034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-16T05:33:05.269139Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.269139Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:e89acd0a47332a4210cf8318fd7b62811c3839b8a719f0a014bc93564589b6c5","observation_id":"e588c4fa-40ad-45cf-8594-b5e998efc6b5","resolution":{"observed_at":"2026-08-16T05:33:05.269139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-16T05:33:05.275081Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.275081Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:60bc663408cf1b415f21be9f87cce7875c4719e8599b32fd4bfa804654e47c12","observation_id":"b21539f5-cfc7-4f20-a131-23be82d88eeb","resolution":{"observed_at":"2026-08-16T05:33:05.275081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18715","last_updated":"2024-06-05T13:53:42Z","snapshot_observed_at":"2026-08-18T10:16:50.487633Z","submitted_at":"2024-03-27T16:04:47Z","title":"Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18715","snapshot_observed_at":"2026-08-16T05:33:05.280684Z","title":"Mitigating hallucinations in large vision-language models with instruction contrastive decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.280684Z"},"links":{"cited_paper":"/paper/2403.18715","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:393395cee22eaaae59c05899004b09cf83feb56b4a8dc2608123233c6381e19d","observation_id":"aa720416-4730-402e-883c-8074faecd8ff","resolution":{"observed_at":"2026-08-16T05:33:05.280684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16216","last_updated":"2026-05-16T18:30:31Z","snapshot_observed_at":"2026-08-12T16:47:35.127541Z","submitted_at":"2024-07-23T06:45:52Z","title":"Reinforcement Learning for LLM Post-Training: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16216","snapshot_observed_at":"2026-08-16T05:33:05.286073Z","title":"A comprehensive survey of llm alignment techniques: Rlhf, rlaif, ppo, dpo and more","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.286073Z"},"links":{"cited_paper":"/paper/2407.16216","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:a14a89d8d0f40e4a67036d48cab6618b52855a74e355cf5ba94b52d6120a2a5b","observation_id":"473d809d-d83c-42f9-b01f-6af87fd5afa9","resolution":{"observed_at":"2026-08-16T05:33:05.286073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14233","last_updated":"2025-01-06T13:58:45Z","snapshot_observed_at":"2026-08-16T13:58:51.888995Z","submitted_at":"2024-04-22T14:46:10Z","title":"Detecting and Mitigating Hallucination in Large Vision Language Models via Fine-Grained AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14233","snapshot_observed_at":"2026-08-16T05:33:05.291842Z","title":"Detecting and mitigating hallucination in large vision language models via fine-grained ai feedback.arXiv preprint arXiv:2404.14233, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.291842Z"},"links":{"cited_paper":"/paper/2404.14233","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:52dd52e20520afc365364ddecb2640bf6fd57a55d26097f2d87efdacea1c8388","observation_id":"0919049e-5d69-4d07-ba68-a5d7490e3ae7","resolution":{"observed_at":"2026-08-16T05:33:05.291842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20974","last_updated":"2024-10-04T17:23:48Z","snapshot_observed_at":"2026-08-16T13:47:21.937691Z","submitted_at":"2024-05-31T16:21:16Z","title":"SaySelf: Teaching LLMs to Express Confidence with Self-Reflective Rationales","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20974","snapshot_observed_at":"2026-08-16T05:33:05.298081Z","title":"Sayself: Teaching llms to express confidence with self-reflective rationales","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.298081Z"},"links":{"cited_paper":"/paper/2405.20974","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:5c89787939396819b3256eaf39c1af01607eb7ed5cd3e29451ed5462cc07d0b0","observation_id":"1c919ffd-fe1c-45f5-8134-9be42f27bbcf","resolution":{"observed_at":"2026-08-16T05:33:05.298081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11903","last_updated":"2025-03-08T12:36:34Z","snapshot_observed_at":"2026-08-16T12:57:40.624030Z","submitted_at":"2025-02-17T15:24:49Z","title":"MMRC: A Large-Scale Benchmark for Understanding Multimodal Large Language Model in Real-World Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11903","snapshot_observed_at":"2026-08-16T05:33:05.303738Z","title":"Mmrc: A large-scale bench- mark for understanding multimodal large language model in real-world conversation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.303738Z"},"links":{"cited_paper":"/paper/2502.11903","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:635fc4dfddfa93fd32e6e7051d92e3cd6e0dccb5b3e54a920888a72d5c75beef","observation_id":"fe7fd7c4-f4d2-436a-a76c-c878656eeded","resolution":{"observed_at":"2026-08-16T05:33:05.303738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-16T05:33:05.308800Z","title":"Qwen2 technical report.arXiv preprint arXiv:2407.10671, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.308800Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:c91be65943d85b27f28bd2b79f0160bdeaf458a7a5ff084d69a916640b97f45f","observation_id":"04bf23eb-5eb0-4f15-a6a4-dc935d353eba","resolution":{"observed_at":"2026-08-16T05:33:05.308800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-16T05:33:05.314149Z","title":"Minicpm-v: A gpt-4v level mllm on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.314149Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:24fff73d327e2a74726f711d879d418bca00dee05a6398b5197e2f48198fbf69","observation_id":"567af210-f6e2-4d43-a72b-7afeaaa97596","resolution":{"observed_at":"2026-08-16T05:33:05.314149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16045","last_updated":"2024-12-11T02:46:29Z","snapshot_observed_at":"2026-08-18T12:54:07.136498Z","submitted_at":"2023-10-24T17:58:07Z","title":"Woodpecker: Hallucination Correction for Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16045","snapshot_observed_at":"2026-08-16T05:33:05.318848Z","title":"Woodpecker: Hallucination correction for multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.318848Z"},"links":{"cited_paper":"/paper/2310.16045","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:50c1a317f2bdcf72b5f7675ee34dd9b0d65193d3bf2af6b2bd867cad76ac0508","observation_id":"342c07b7-357b-4e85-b4c6-c93df8277f38","resolution":{"observed_at":"2026-08-16T05:33:05.318848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.900933Z","title":"Hallucidoctor: Mitigating hallucinatory toxicity in visual instruction data","venue":null,"work_id":"568fd757-c866-4879-98ed-1e2a31c3b7cb","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.323705Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:fde940243b3ca3ef7407fb51b262f59944848c865267ed0d85f294cc3f1561b9","observation_id":"0ae297ea-da95-4198-8f29-85e0f59b33cb","resolution":{"observed_at":"2026-08-16T05:33:05.908738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-18T03:16:44.825874Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-16T05:33:05.328752Z","title":"Mm-vet: Evaluating large multimodal models for integrated capabilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.328752Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:5eee7d77703e57677bdca280f01997874796502860648d7bb63bd3de5256bd6a","observation_id":"014d6c58-fba8-4a97-bee2-342641acc0c1","resolution":{"observed_at":"2026-08-16T05:33:05.328752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05262","last_updated":"2025-08-14T12:30:25Z","snapshot_observed_at":"2026-08-16T14:11:38.516056Z","submitted_at":"2024-03-08T12:35:07Z","title":"Debiasing Multimodal Large Language Models via Penalization of Language Priors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05262","snapshot_observed_at":"2026-08-16T05:33:05.333246Z","title":"Debiasing large visual language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.333246Z"},"links":{"cited_paper":"/paper/2403.05262","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:9d7b1885a6a0f8c4f509020772926696098f2b9a2b821aed89401ffee4f6a84b","observation_id":"67c6cb01-0e37-473b-8145-0ddafbe53340","resolution":{"observed_at":"2026-08-16T05:33:05.333246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16839","last_updated":"2024-02-06T16:43:31Z","snapshot_observed_at":"2026-08-16T19:33:05.632918Z","submitted_at":"2023-11-28T14:54:37Z","title":"Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16839","snapshot_observed_at":"2026-08-16T05:33:05.339602Z","title":"Beyond hallucinations: Enhanc- ing lvlms through hallucination-aware direct preference op- timization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.339602Z"},"links":{"cited_paper":"/paper/2311.16839","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:68c615bd8be7e709293826ba4684429e3483421a6f0ee49035853d19d6b8014d","observation_id":"d81f5793-b83a-4b86-858e-c5c55205bff8","resolution":{"observed_at":"2026-08-16T05:33:05.339602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10501","last_updated":"2024-08-21T11:36:47Z","snapshot_observed_at":"2026-08-16T14:00:32.744525Z","submitted_at":"2024-04-16T12:19:54Z","title":"Self-Supervised Visual Preference Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10501","snapshot_observed_at":"2026-08-16T05:33:05.345013Z","title":"Self- supervised visual preference alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.345013Z"},"links":{"cited_paper":"/paper/2404.10501","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:e2cdfc3dee5b33fa46ef9822def495247ebd1010ac7ad22fe34be753464ac953","observation_id":"5782e471-7e5e-412d-8b52-4fefb243f4a1","resolution":{"observed_at":"2026-08-16T05:33:05.345013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T11:35:12.830220Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2504.20468."}