{"as_of":"2026-08-08T23:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:616a22424e0fc29f6b84080cd99c7c192f1a2b9d86968ff1e854effcee76485c","coverage":[{"denominator":87,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":87,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:33:13.820971Z","state":"measured"},{"denominator":91,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":91,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:39:03.028373Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24238","snapshot_observed_at":"2026-08-05T10:39:03.028373Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-08T03:54:26.940042Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:03.028373Z"},"links":{"cited_paper":"/paper/2505.24238","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:e4b6a7e7d06c8189ac8c775f7781a51c5c297c92343357fc61d6b20d29e1b69e","observation_id":"8f61cce6-5c2d-4d17-8b3f-2c8cc3ad9045","resolution":{"observed_at":"2026-08-05T10:39:03.028373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"cited_work":{"arxiv_id":"2505.24238","doi":"10.48550/arxiv.2505.24238","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24238","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mirage: Assessing hal- lucination in multimodal reasoning chains of mllm","venue":"ArXiv.org","work_id":"e1b2fa10-0b42-496c-a013-661376a69b10","year":2025},"citing_paper":{"arxiv_id":"2604.03179","last_updated":"2026-04-03T16:56:34Z","snapshot_observed_at":"2026-07-06T22:52:25.307426Z","submitted_at":"2026-04-03T16:56:34Z","title":"Understanding the Role of Hallucination in Reinforcement Post-Training of Multimodal Reasoning Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T20:48:52.130130Z"},"links":{"cited_paper":"/paper/2505.24238","citing_paper":"/paper/2604.03179"},"observation_digest":"sha256:7c7b7448e349a8d5f9fe53b452ec9dca9d1fc9de23023d5313076869d7d9d82a","observation_id":"93d009a1-1467-4909-ae1a-aa45d4e09569","resolution":{"observed_at":"2026-05-13T20:53:16.282414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"cited_work":{"arxiv_id":"2505.24238","doi":"10.48550/arxiv.2505.24238","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24238","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mirage: Assessing hal- lucination in multimodal reasoning chains of mllm","venue":"ArXiv.org","work_id":"e1b2fa10-0b42-496c-a013-661376a69b10","year":2025},"citing_paper":{"arxiv_id":"2604.21027","last_updated":"2026-08-02T16:15:42Z","snapshot_observed_at":"2026-08-06T23:24:26.820832Z","submitted_at":"2026-04-22T19:18:36Z","title":"HypEHR: Hyperbolic Modeling of Electronic Health Records for Efficient Question Answering","version":1},"reference_index":230,"source":"arxiv_source","source_observed_at":"2026-05-09T23:51:47.724033Z"},"links":{"cited_paper":"/paper/2505.24238","citing_paper":"/paper/2604.21027"},"observation_digest":"sha256:0304d1797e493116bb000981919d99d33b0c056990797cc0eaeeedde5165b7f0","observation_id":"8db78eb4-7cbe-4125-83e5-637815967363","resolution":{"observed_at":"2026-05-09T23:54:45.651801Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"cited_work":{"arxiv_id":"2505.24238","doi":"10.48550/arxiv.2505.24238","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24238","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mirage: Assessing hal- lucination in multimodal reasoning chains of mllm","venue":"ArXiv.org","work_id":"e1b2fa10-0b42-496c-a013-661376a69b10","year":2025},"citing_paper":{"arxiv_id":"2604.23392","last_updated":"2026-04-25T17:46:59Z","snapshot_observed_at":"2026-07-06T23:09:38.799345Z","submitted_at":"2026-04-25T17:46:59Z","title":"SoccerRef-Agents: Multi-Agent System for Automated Soccer Refereeing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T08:03:57.287297Z"},"links":{"cited_paper":"/paper/2505.24238","citing_paper":"/paper/2604.23392"},"observation_digest":"sha256:72702f970b9f340d9decd613b9ef96b9f693e5bfca93f3e605aaf486d425235a","observation_id":"45eb3f94-6839-4143-946f-13d83c6c4310","resolution":{"observed_at":"2026-05-11T20:46:13.723544Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.24238/citation-record","integrity":"/paper/2505.24238/integrity","json":"/paper/2505.24238/citation-record.json","paper":"/paper/2505.24238"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T12:33:06.080923Z","title":"Phi-3 technical report: A highly capable language model locally on your phone.arXiv preprint arXiv:2404.14219, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.080923Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:c74cf743962a312c55e498ded18dca1bf47c2e7b931a5d45673a4c0f0ba691fb","observation_id":"cd373f87-c04c-4530-bc32-e4af6da0f6fd","resolution":{"observed_at":"2026-08-07T12:33:06.080923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T12:33:06.122153Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.122153Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:8dfd0fe05d264b102e02bc8d60646d10073c21d8b4299cadb72c3e6b8172670a","observation_id":"1f5eb507-8925-4c9a-b2f3-080a49e013e3","resolution":{"observed_at":"2026-08-07T12:33:06.122153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03631","last_updated":"2024-10-16T19:35:55Z","snapshot_observed_at":"2026-07-06T16:57:51.263433Z","submitted_at":"2023-12-06T17:28:03Z","title":"Mitigating Open-Vocabulary Caption Hallucinations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03631","snapshot_observed_at":"2026-08-07T12:33:06.187286Z","title":"Mocha: Multi-objective reinforcement mitigating caption hallucinations.arXiv preprint arXiv:2312.03631, 2, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.187286Z"},"links":{"cited_paper":"/paper/2312.03631","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:67e7d4cdf953469f2fb46f31c4a269741b615c94e36c3d79c7b8e585aeaf829c","observation_id":"e235ea63-d9dd-4ac5-bd0b-e70324949e95","resolution":{"observed_at":"2026-08-07T12:33:06.187286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-02T08:38:17.217627Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-08-07T12:33:06.268894Z","title":"Mm-iq: Benchmarking human-like abstraction and reasoning in multimodal models.arXiv preprint arXiv:2502.00698, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.268894Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:d90ce5388158b484dc19a1af18f56386be207ad66af35c4849a508ad03bca287","observation_id":"0ac1d8d1-47ac-46b8-a4fa-ba1fb0af3714","resolution":{"observed_at":"2026-08-07T12:33:06.268894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:06.382734Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.382734Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:79a32f166ff072b99ca2642c8757dd43aa980f5497e3d25e111175264599fe6b","observation_id":"a02ce98e-e834-4a5d-8358-f84a06c5ca25","resolution":{"observed_at":"2026-08-07T12:33:06.382734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16479","last_updated":"2023-11-27T09:30:02Z","snapshot_observed_at":"2026-07-06T16:53:35.776613Z","submitted_at":"2023-11-27T09:30:02Z","title":"Mitigating Hallucination in Visual Language Models with Visual Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16479","snapshot_observed_at":"2026-08-07T12:33:06.475621Z","title":"Mitigating hallucination in visual language models with visual supervision.arXiv preprint arXiv:2311.16479, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.475621Z"},"links":{"cited_paper":"/paper/2311.16479","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:46e43b8a971833411aaf8ca5eeb2b0e578ad3d8aaf8c1debbccbe248b6b1509f","observation_id":"6b2a2fc9-cbcb-4800-9df7-e62cbf88b301","resolution":{"observed_at":"2026-08-07T12:33:06.475621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:06.558504Z","title":"Puzzlevqa: Diagnosing multimodal reasoning challenges of language models with abstract visual patterns","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.558504Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:381a3b9b476b33e5f7c38926ce008c8de3f103e4abecd53f548e6d435cefeda8","observation_id":"60e44d62-1f95-4794-bbb8-ed07a8806100","resolution":{"observed_at":"2026-08-07T12:33:06.558504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:06.634033Z","title":"Zero-shot generalizable incremental learning for vision-language object detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.634033Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:98ac84cc84da61bf1a9fb2baa03d3a48d194a4a8fc8da30ca8f357d7208587e2","observation_id":"e6c82916-4191-463e-9612-10cbbf6c873d","resolution":{"observed_at":"2026-08-07T12:33:06.634033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15979","last_updated":"2024-12-23T16:55:57Z","snapshot_observed_at":"2026-08-08T03:24:24.934169Z","submitted_at":"2024-12-20T15:22:51Z","title":"MR-GDINO: Efficient Open-World Continual Object Detection","version":2},"cited_work":{"arxiv_id":"2412.15979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15979","snapshot_observed_at":"2026-08-07T12:33:14.622898Z","title":"MR-GDINO: Efficient Open-World Continual Object Detection","venue":"cs.CV","work_id":"429f1ade-2c6a-426f-a961-1c3c0845fa18","year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.701427Z"},"links":{"cited_paper":"/paper/2412.15979","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:a9921f06bcf5cc486c3c29d89be0d29fb58dad9ecf8ddcf15d56690b407100b8","observation_id":"d23fb554-b6b2-4c64-80be-3802ef89af64","resolution":{"observed_at":"2026-08-07T12:33:14.676390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:06.750153Z","title":"Lpt: Long-tailed prompt tuning for image classification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.750153Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:e7550c2fb072f72636701ff317e538890a8c55cad543e90cdac1a333d35c5d54","observation_id":"f50f399f-d566-4461-af0e-1f313c9b77a1","resolution":{"observed_at":"2026-08-07T12:33:06.750153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-07T12:33:06.816254Z","title":"A survey on in-context learning.arXiv preprint arXiv:2301.00234, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.816254Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:11311bbffa69f651e08df39b2279565ee365eb8d9e25ea13c459e6f2bda891ea","observation_id":"40226a05-9e99-486a-8a25-e68cf003dc0d","resolution":{"observed_at":"2026-08-07T12:33:06.816254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01904","last_updated":"2025-02-05T09:17:01Z","snapshot_observed_at":"2026-08-08T00:29:08.656523Z","submitted_at":"2025-01-03T17:14:16Z","title":"Virgo: A Preliminary Exploration on Reproducing o1-like MLLM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01904","snapshot_observed_at":"2026-08-07T12:33:06.915732Z","title":"Virgo: A preliminary exploration on reproducing o1-like mllm.arXiv preprint arXiv:2501.01904, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.915732Z"},"links":{"cited_paper":"/paper/2501.01904","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:889bdef067998622057e793486c11a3863c764898a6183f4b14646db26abfdb1","observation_id":"ea35cb9c-7fd7-4ce0-bc0d-e7d524fc5b9f","resolution":{"observed_at":"2026-08-07T12:33:06.915732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:07.022394Z","title":"Detecting hallucinations in large language models using semantic entropy.Nature, 630(8017):625–630, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:07.022394Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:f26dee1badbdc23855ace8e6ae99b88e1f660589737255bdacec94d4299cb363","observation_id":"49e1bd80-b7be-43fc-863d-fb2bf75fdb27","resolution":{"observed_at":"2026-08-07T12:33:07.022394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-07T12:33:07.090750Z","title":"Mme: A comprehensive evaluation benchmark for multimodal large language models.arXiv preprint arXiv:2306.13394, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:07.090750Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:45f21b64be1ed504525586a49f505b97b738f021e783c3abd1309d98e173c900","observation_id":"b3dc9fb6-d758-4d73-af6e-464ab485d758","resolution":{"observed_at":"2026-08-07T12:33:07.090750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:07.151002Z","title":"GPTScore: Evaluate as you desire","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:07.151002Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:34cad54162951558833a072f7dee903fb30c7941056a8096af9ec35fb3e27a9a","observation_id":"6cd15c42-a470-4dbe-9f0d-e99b8db63c67","resolution":{"observed_at":"2026-08-07T12:33:07.151002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:07.271503Z","title":"The capacity for moral self-correction in large language models.Parameters, 109(1010):1011","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:07.271503Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:7fd72525483f266a8513c8bba7880af35352e47c9e4b8f078b14536c29752af5","observation_id":"85588250-a0aa-44c6-a5fe-3bd9c163fbff","resolution":{"observed_at":"2026-08-07T12:33:07.271503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03864","last_updated":"2024-03-13T00:50:05Z","snapshot_observed_at":"2026-07-06T17:40:33.769700Z","submitted_at":"2024-03-06T17:15:04Z","title":"Are Language Models Puzzle Prodigies? Algorithmic Puzzles Unveil Serious Challenges in Multimodal Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03864","snapshot_observed_at":"2026-08-07T12:33:07.360301Z","title":"Are language models puzzle prodigies? algorithmic puzzles unveil serious challenges in multimodal reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:07.360301Z"},"links":{"cited_paper":"/paper/2403.03864","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:5a5bb8fbc960a0c2e560c43c7f9e62a64a7b08b4ebdb35d0646cd786bdb8066f","observation_id":"131f8f24-faff-4e6e-9cc9-ecdc554449ba","resolution":{"observed_at":"2026-08-07T12:33:07.360301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:33:07.475863Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:07.475863Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:2cb6690d971643bc93dcee785b2f3cbc3853068c3c086e0c6631c7e60d2f52bd","observation_id":"d385e19b-f4e6-4955-89e5-25a3370bbfea","resolution":{"observed_at":"2026-08-07T12:33:07.475863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T12:33:07.571919Z","title":"A survey on llm-as-a-judge.arXiv preprint arXiv:2411.15594, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:07.571919Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:970fe27cb504546cbb5618a009b39a35ad795ef3f712b7ef2cf7543dff026586","observation_id":"82fb3068-1a9f-4e79-a8f4-edb963f00afd","resolution":{"observed_at":"2026-08-07T12:33:07.571919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:07.664840Z","title":"Hallusionbench: an advanced diagnostic suite for entangled language hallucination and visual illusion in large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:07.664840Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:0e8bfbd0eec0f1205d37057957f1ee643399dcb44447f4174d8a9e78f08c745a","observation_id":"a4bcd11f-f250-480f-bf44-546db8c7a328","resolution":{"observed_at":"2026-08-07T12:33:07.664840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:33:07.772797Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:07.772797Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:b5e14e5a3a1ae50c77dfdc77a110a99f968d1a93f23845a1a2295ea4e4f32e7b","observation_id":"aaf1ac63-d878-4cb2-807b-c8f4228efe91","resolution":{"observed_at":"2026-08-07T12:33:07.772797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01887","last_updated":"2025-02-27T03:39:10Z","snapshot_observed_at":"2026-08-07T17:44:15.581009Z","submitted_at":"2025-02-27T03:39:10Z","title":"When Continue Learning Meets Multimodal Large Language Model: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01887","snapshot_observed_at":"2026-08-07T12:33:07.869192Z","title":"When continue learning meets multimodal large language model: A survey.arXiv preprint arXiv:2503.01887, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:07.869192Z"},"links":{"cited_paper":"/paper/2503.01887","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:16c8ed606f424170e821a3763bb59eaf572e984e73d98744afafe363267508d0","observation_id":"e4ea4dc8-3afa-4b0e-a85f-889900e9f05d","resolution":{"observed_at":"2026-08-07T12:33:07.869192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T12:33:07.959565Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:07.959565Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:ba5a23f1fa2f65211460d14015c4c47e93a2ab98d66f7bc7464689471c44c268","observation_id":"3c11f0aa-8b18-422f-9198-fd055ab6103c","resolution":{"observed_at":"2026-08-07T12:33:07.959565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T12:33:08.049492Z","title":"Openai o1 system card.arXiv preprint arXiv:2412.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:08.049492Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:971953c2bc5c5ed8a4f0c55f6b221b05a25bef7a02638515638410bfa8d7981b","observation_id":"efeed5f0-0c9e-4944-a8b8-e7aa228c618e","resolution":{"observed_at":"2026-08-07T12:33:08.049492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:18.358252Z","title":"Towards mitigating LLM hallucination via self reflection","venue":null,"work_id":"7faf17ea-8cd0-4434-9b1e-b8663d88d4cc","year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:08.183950Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:527aa8e2723a9b2490302cec567e48d2cdf1b07e09eb092355963c9e629582ad","observation_id":"ffa0a01f-ae22-4626-935d-4c149f169e29","resolution":{"observed_at":"2026-08-07T12:33:18.503341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:08.290558Z","title":"Hallucination augmented contrastive learning for multimodal large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:08.290558Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:d0126477c50909c2afeab8441e041168294d4a876e22b817b9f1b65810817b89","observation_id":"62c94a89-a059-4823-bb1d-acd48b4486d5","resolution":{"observed_at":"2026-08-07T12:33:08.290558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09621","last_updated":"2025-02-13T18:59:46Z","snapshot_observed_at":"2026-08-07T20:46:02.743961Z","submitted_at":"2025-02-13T18:59:46Z","title":"MME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09621","snapshot_observed_at":"2026-08-07T12:33:08.379110Z","title":"Mme-cot: Benchmarking chain-of-thought in large multimodal models for reasoning quality, robustness, and efficiency.arXiv preprint arXiv:2502.09621, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:08.379110Z"},"links":{"cited_paper":"/paper/2502.09621","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:7846dbe2f5b27491d86629474988c5f99bb85cde2bf06afe592bcdccdc240097","observation_id":"a72d196d-62cc-4209-83be-37aec9055dc7","resolution":{"observed_at":"2026-08-07T12:33:08.379110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:18.048689Z","title":"Decoupling representation and classifier for long-tailed recognition","venue":null,"work_id":"d729828f-0b8c-4f1e-9914-c9f13d112344","year":null},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:08.480767Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:7747d56e0514d44fad791986e55018977cb1ea12fc6a4877ba6de8c697ef64ee","observation_id":"d3eabd59-e4da-4a04-a2a9-c88aed94f37e","resolution":{"observed_at":"2026-08-07T12:33:18.166965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:08.559186Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:08.559186Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:cab89c7db9e718bb2ada8886baeaada8dcaaa02705227afecb2eb706d2f56319","observation_id":"2e8ba4f8-f945-4fb9-9e87-57bb85616c2f","resolution":{"observed_at":"2026-08-07T12:33:08.559186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-07T12:33:08.631430Z","title":"Seed- bench: Benchmarking multimodal llms with generative comprehension.arXiv preprint arXiv:2307.16125, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:08.631430Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:803b06700774b42a97693c6f861506d680bd06fa335432bb9f918fc023704879","observation_id":"c3e2ac17-0813-463f-9f74-946b2dfbbd0c","resolution":{"observed_at":"2026-08-07T12:33:08.631430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-07-31T01:42:39.468673Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05579","snapshot_observed_at":"2026-08-07T12:33:08.729239Z","title":"Llms-as-judges: a comprehensive survey on llm-based evaluation methods.arXiv preprint arXiv:2412.05579, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:08.729239Z"},"links":{"cited_paper":"/paper/2412.05579","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:ffa45a663f95feda77757a75bb90314429baf8b9e19082c4833dbd95566d7282","observation_id":"5dc004e3-889e-47bb-aa86-7f110d4a3be6","resolution":{"observed_at":"2026-08-07T12:33:08.729239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:08.797773Z","title":"Salad-bench: A hierarchical and comprehensive safety benchmark for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:08.797773Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:da207ccd38061869a40d6835f99e111c86aaae19fb47d60c9640b00e8e8d028d","observation_id":"3042c996-c970-4899-9c34-7b2afc9e70d9","resolution":{"observed_at":"2026-08-07T12:33:08.797773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:17.785846Z","title":"Long-tailed visual recognition via gaussian clouded logit adjustment","venue":null,"work_id":"2549a02f-27a7-4c29-8134-5c60307f0945","year":2022},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:08.934739Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:0374e8d248ac9d770f7c26008237aab3428c9da674313e7addf92953f7971c90","observation_id":"ebe72b6c-d1fb-434d-b5a8-7dd39b936bf4","resolution":{"observed_at":"2026-08-07T12:33:17.903767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:17.559701Z","title":"Evaluating object hallucination in large vision-language models","venue":null,"work_id":"146320e4-019e-4bce-add9-7b029e26eb5b","year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:09.006807Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:37b83c1c2513f3c12641fcc1967eb9cec519abb66de9b8acb7ce958bd9c88644","observation_id":"4b24e925-a8de-49f7-ae0e-ae79231d2290","resolution":{"observed_at":"2026-08-07T12:33:17.659774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:09.096630Z","title":"Omnibench: Towards the future of universal omni-language models.arXiv preprint arXiv:2409.15272, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:09.096630Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:35a1af6042c5f97e235917a56c7c732ca9eb6dd3aa73ec39e465bed3c8440283","observation_id":"a46d00ea-67a9-4727-8ff8-6fe63c8f0dda","resolution":{"observed_at":"2026-08-07T12:33:09.096630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T12:33:09.169761Z","title":"Deepseek-v3 technical report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:09.169761Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:ad5e02813878538f3707dba2d39942154f5babea4c28ec02075d57d7a4f5d8c8","observation_id":"ef6c1503-b847-4245-861e-fa84899b4c71","resolution":{"observed_at":"2026-08-07T12:33:09.169761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:17.346063Z","title":"Mitigat- ing hallucination in large multi-modal models via robust instruction tuning","venue":null,"work_id":"27a04a3e-a596-4f14-910c-746754311e0a","year":null},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:09.244473Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:7e4d80a037f78b259d91cdf7e9914ad7c1cd1dd85175957d25f486cdcd9e1234","observation_id":"169dedb4-ccf8-4215-b20e-99bfc5d5e067","resolution":{"observed_at":"2026-08-07T12:33:17.441938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:17.034810Z","title":"Visual instruction tuning, 2023","venue":null,"work_id":"6977991b-1598-4c03-b8ed-7cba7804aebb","year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:09.337797Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:71f18cfb61dcaaa41658b326b93fe7c90258c8b370253f1be61548b15e971fad","observation_id":"a549b860-d5f8-4579-88d9-6e0627e2fb8f","resolution":{"observed_at":"2026-08-07T12:33:17.186401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01785","last_updated":"2025-03-03T18:16:32Z","snapshot_observed_at":"2026-08-05T03:13:54.147007Z","submitted_at":"2025-03-03T18:16:32Z","title":"Visual-RFT: Visual Reinforcement Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01785","snapshot_observed_at":"2026-08-07T12:33:09.432965Z","title":"Visual-rft: Visual reinforcement fine-tuning.arXiv preprint arXiv:2503.01785, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:09.432965Z"},"links":{"cited_paper":"/paper/2503.01785","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:1f8930a124e6695ff417d8a86471dc7c07f8573ea605790c903a5cdb8a41d605","observation_id":"2551a763-37bd-41ce-931b-e4db63c3bf7d","resolution":{"observed_at":"2026-08-07T12:33:09.432965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:09.543779Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:09.543779Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:48a5dbe4007ea784aff0f37ca40d2090f7fe1bac938bd00842841647781e154c","observation_id":"7f6f5d91-2270-4ad3-be3f-e631d7dceb6c","resolution":{"observed_at":"2026-08-07T12:33:09.543779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:09.643603Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:09.643603Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:6077c4f8c7630360682ef943806aa1f6cde0f655a0e4e6c996bb8b1995b37d53","observation_id":"b7779aaa-102d-49ed-8517-7739ee88a52b","resolution":{"observed_at":"2026-08-07T12:33:09.643603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:09.735339Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:09.735339Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:9ab7c1c48d903b334c238d88475cca70cb539ffaad815580733d1625fda2c717","observation_id":"50b2646c-45b8-47df-92bf-d05cb8e0947f","resolution":{"observed_at":"2026-08-07T12:33:09.735339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:09.808767Z","title":"Ursa: Understanding and verifying chain-of-thought reasoning in multimodal mathematics.arXiv preprint arXiv:2501.04686, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:09.808767Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:5dc508ec78b5541bcb0ef3b177edc88a81d996d13232aa746fc33ac817dd804d","observation_id":"0c0d71be-894d-4563-aa5a-2caaf14733de","resolution":{"observed_at":"2026-08-07T12:33:09.808767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:09.913245Z","title":"Ok-vqa: A visual question answering benchmark requiring external knowledge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:09.913245Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:8566d72d04ba28713389187bd9aee9d3ad06748874b7eb2661f5209fa2b34a6c","observation_id":"63567212-d451-45be-8661-10868da2d31b","resolution":{"observed_at":"2026-08-07T12:33:09.913245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:09.990090Z","title":"Chartqa: A benchmark for question answering about charts with visual and logical reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:09.990090Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:57c5150fc62abefa2a83e99b628c51e0de3135cf22fa263aaa2704d35bfee7d1","observation_id":"d1fc6cd4-025a-416c-a8d9-0a324dbcea08","resolution":{"observed_at":"2026-08-07T12:33:09.990090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-07-06T20:49:56.018809Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-07T12:33:10.071390Z","title":"Mm-eureka: Exploring visual aha moment with rule-based large-scale reinforcement learning.arXiv preprint arXiv:2503.07365, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:10.071390Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:cad75a83b846ec3d7a36d733d7719d06c2fead485fd07b4c9da94558f972468c","observation_id":"d12ecdd1-663f-4408-a3f2-485ff7baeab6","resolution":{"observed_at":"2026-08-07T12:33:10.071390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:10.139052Z","title":"Compositional chain-of- thought prompting for large multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:10.139052Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:213f6f3117fd98f124130c6220e6c7e1999e9bdf78f56a8d86a34add4b987769","observation_id":"4d684078-fce3-4628-b438-3871fe71aeab","resolution":{"observed_at":"2026-08-07T12:33:10.139052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:10.217648Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:10.217648Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:b0007f5d52f3daf70d4c9f81ec2a71500700604001c92a7be02a4c250fdcfc30","observation_id":"a53719f6-9c58-428f-b724-d963b96de839","resolution":{"observed_at":"2026-08-07T12:33:10.217648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-07T12:33:10.310457Z","title":"Lmm-r1: Empowering 3b lmms with strong reasoning abilities through two-stage rule-based rl.arXiv preprint arXiv:2503.07536, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:10.310457Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:5739b77cca61b08165416e69402986401f29f466d7ee17f67fce2e350974e9f6","observation_id":"04a56abd-815d-43aa-81bf-37bc82357b95","resolution":{"observed_at":"2026-08-07T12:33:10.310457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10703","last_updated":"2023-11-30T23:33:07Z","snapshot_observed_at":"2026-08-04T12:27:12.584527Z","submitted_at":"2023-04-21T02:19:06Z","title":"ReCEval: Evaluating Reasoning Chains via Correctness and Informativeness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10703","snapshot_observed_at":"2026-08-07T12:33:10.405095Z","title":"Receval: Evaluating reasoning chains via correctness and informativeness.arXiv preprint arXiv:2304.10703, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:10.405095Z"},"links":{"cited_paper":"/paper/2304.10703","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:87fc01374974e5291beec7310d56f783d24c18fab4bc1e6f7b8eb154d9b53903","observation_id":"9e83b7d7-971b-4220-8f1f-5ce5d603d714","resolution":{"observed_at":"2026-08-07T12:33:10.405095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:16.662088Z","title":"Mitigating object hallucination in mllms via data-augmented phrase-level alignment","venue":null,"work_id":"72fdd5b8-5f81-4f2b-a9a9-e50e1cfa29ed","year":null},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:10.547565Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:ce48fe9bc4134f9a2ddb7ee48436681380b5df467a7240147a9ec171f0fc5a56","observation_id":"698b7e53-57d5-4cb9-a2ee-331fa319c673","resolution":{"observed_at":"2026-08-07T12:33:16.787632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:33:10.633888Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:10.633888Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:0ecda17c2eed4ca800d6ef35cf7f00ffb5fcf2f18c30c08d7890ecff9e62f5cf","observation_id":"284f205c-e24d-49d4-98ed-c7382e884264","resolution":{"observed_at":"2026-08-07T12:33:10.633888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:33:10.745345Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:10.745345Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:d6992bed346aab455e868e89dd261e17d4d9f6ea26f6fe5319ed94293300282b","observation_id":"a0bec2fa-ad09-47da-9b3d-dcfc443a20cb","resolution":{"observed_at":"2026-08-07T12:33:10.745345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:10.856167Z","title":"Monte carlo tree search: A review of recent modifications and applications.Artificial Intelligence Review, 56(3):2497–2562, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:10.856167Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:4cfd2f3c074bc051e6700bd727d83678785d548d5bcae16523ecca0df3a4fee9","observation_id":"b2b2aefe-d4c4-4b50-9c4c-dffc83574f91","resolution":{"observed_at":"2026-08-07T12:33:10.856167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T12:33:10.924496Z","title":"Gemini: a family of highly capable multimodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:10.924496Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:0b0f51e81138ce714f85c333b142bb66537cd3a20eefcfcd3d2de33d26111fd8","observation_id":"dcba0640-8e74-499b-936a-ba7fdccf62b7","resolution":{"observed_at":"2026-08-07T12:33:10.924496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:16.558078Z","title":"QVQ: To See the World with Wisdom","venue":null,"work_id":"3ebd8de2-774f-44af-97d8-c5bad45a67e0","year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.048068Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:93f37d7884e5cc0aac2bba38f0d12bc16f592921b411bb6bc21ab024671588e5","observation_id":"443738d3-a1a4-4e01-8fa7-10e641d3eecb","resolution":{"observed_at":"2026-08-07T12:33:16.606887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10960","last_updated":"2024-04-16T23:56:38Z","snapshot_observed_at":"2026-07-06T18:01:14.416754Z","submitted_at":"2024-04-16T23:56:38Z","title":"Uncertainty-Based Abstention in LLMs Improves Safety and Reduces Hallucinations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10960","snapshot_observed_at":"2026-08-07T12:33:11.153366Z","title":"Uncertainty-based abstention in llms improves safety and reduces hallucinations.arXiv preprint arXiv:2404.10960, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.153366Z"},"links":{"cited_paper":"/paper/2404.10960","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:8526795e3bf54c3e311c0689145487a6f159cc80393ca984153dbd3793ada18a","observation_id":"61e93b22-71a1-4bf0-957f-2c3634b8c1f2","resolution":{"observed_at":"2026-08-07T12:33:11.153366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:11.217618Z","title":"Eyes wide shut? exploring the visual shortcomings of multimodal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.217618Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:5992c4548034ac22ce26202c13df05cfef0b51750e36c782bb7b5e8ab6c0d2db","observation_id":"8084a308-e4ac-4805-9d83-a724b7daae11","resolution":{"observed_at":"2026-08-07T12:33:11.217618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:16.433777Z","title":"Measuring multimodal mathematical reasoning with math-vision dataset","venue":null,"work_id":"830a1c6e-4181-42a9-90b0-7d14b6a89282","year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.281006Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:85ec35074861f0ba67a06a10e7a54ad852a6df477934a664e4782bf3be4dcc69","observation_id":"e08b3ec0-020d-434d-8a05-7a02209f9913","resolution":{"observed_at":"2026-08-07T12:33:16.486557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T12:33:11.350592Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.350592Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:83c0af760b788c390f02e77e1387717cdb9cb4565f48b817d8b528089b39da80","observation_id":"22da4bca-b3c8-4658-8779-f635c78267e6","resolution":{"observed_at":"2026-08-07T12:33:11.350592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:11.422440Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.422440Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:9ef288caae126ffe70184d525c0c22d9a7e5fa353e5dc182522ac9156ea7b96b","observation_id":"1772c607-1e3e-4cc8-a011-797bd52d4277","resolution":{"observed_at":"2026-08-07T12:33:11.422440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17821","last_updated":"2024-12-16T10:27:35Z","snapshot_observed_at":"2026-07-06T18:21:05.410042Z","submitted_at":"2024-05-28T04:41:02Z","title":"RITUAL: Random Image Transformations as a Universal Anti-hallucination Lever in Large Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17821","snapshot_observed_at":"2026-08-07T12:33:11.492919Z","title":"Ritual: Ran- dom image transformations as a universal anti-hallucination lever in lvlms.arXiv preprint arXiv:2405.17821, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.492919Z"},"links":{"cited_paper":"/paper/2405.17821","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:9c96cf98e69e04a891fab21a9d41ffca66e4600cb4cc730becee0ce2fad79c20","observation_id":"edbb8b53-7b56-4357-9147-0fd3e8b09e71","resolution":{"observed_at":"2026-08-07T12:33:11.492919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:16.236580Z","title":"Autohallusion: Automatic gen- eration of hallucination benchmarks for vision-language models","venue":null,"work_id":"e4da8994-d3af-44bf-bfcb-5506e12b4e00","year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.562584Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:2ac7cb6a6a0d57255728cc965115145abeae1b3ae55d335f97715a24982c0629","observation_id":"630b0b44-60ff-4031-b5bd-136c5134da95","resolution":{"observed_at":"2026-08-07T12:33:16.317333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:16.021405Z","title":"Grok 3 Beta — The Age of Reasoning Agents.https://x.ai/grok, 2025","venue":null,"work_id":"ca22c377-da75-4dee-b958-43d0d20698ab","year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.613404Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:a4d063bcf46054e5881205718568554710d10cf5d10017747ffd7a24b6c4828e","observation_id":"2767d4b3-7a1e-44f6-9233-16d9eaf5c5ab","resolution":{"observed_at":"2026-08-07T12:33:16.123781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:15.892304Z","title":"Mitigating object hallucination via concentric causal attention.Advances in Neural Information Processing Systems, 37:92012–92035, 2024","venue":null,"work_id":"64674a95-2ce7-43ca-9dfa-6d551f3a10be","year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.724385Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:d6b5f39fbeb62e11b385a132e40e1702d2ede5c2a0755add8b0793e7f2ba2591","observation_id":"9b1c93ed-31f5-4c5e-aef0-419a9196b660","resolution":{"observed_at":"2026-08-07T12:33:15.957279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:15.753534Z","title":"Llava-cot: Let vision language models reason step-by-step, 2024","venue":null,"work_id":"650c66cd-bfcd-4e14-b193-a06e84aa41de","year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.795732Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:5a2ebb4a63974a50081de7761e123873eff211d01ff280bc9b9666a3055ff0e4","observation_id":"6ce3eff8-0eda-42fa-bd40-3d76fa9bab4f","resolution":{"observed_at":"2026-08-07T12:33:15.820797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T12:33:11.894050Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.894050Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:179a6e3de6824e385b24c7345870ebfde521f82744bc2e9f0540b7f00fbba908","observation_id":"eebbacd3-290d-40b6-9616-cec260b62609","resolution":{"observed_at":"2026-08-07T12:33:11.894050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:15.615351Z","title":"Soft-prompting with graph-of-thought for multi-modal representation learning","venue":null,"work_id":"7853f1e8-e2ac-4384-a2b2-a2381b7f7279","year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:11.952400Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:27c0f0ebe81ef0f2fcf8a80704ea8a73cc8a19f1912b42562e417b08a9377a68","observation_id":"98b48a0d-4c30-470a-b2d7-380e837c3767","resolution":{"observed_at":"2026-08-07T12:33:15.698313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:15.512064Z","title":"Mitigating hallucination in large vision- language models via modular attribution and intervention","venue":null,"work_id":"f74ec223-eced-4598-b8dd-6642c33d82be","year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:12.053954Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:68f7546afa0aabe1b355f760321054b8e15f601a20053fbef849dd9e5a2afbe7","observation_id":"9304223c-8c7d-4574-b644-7bb3046630c9","resolution":{"observed_at":"2026-08-07T12:33:15.543195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-07T12:50:27.666060Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10615","snapshot_observed_at":"2026-08-07T12:33:12.177383Z","title":"R1-onevision: Advancing generalized multimodal reasoning through cross-modal formalization.arXiv preprint arXiv:2503.10615, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:12.177383Z"},"links":{"cited_paper":"/paper/2503.10615","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:9032533193c745bb2852bdd1f8ec8ec6d89a0ec2d4650243b73b4450cca4382b","observation_id":"73dcefd7-a958-4dd6-bded-72c5e627c82b","resolution":{"observed_at":"2026-08-07T12:33:12.177383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-08T00:04:35.299538Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T12:33:12.258432Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:12.258432Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:fe36a592acc6d930c0791a8fd0c95207de40c7dd82dff4746053febf8ad09c96","observation_id":"0b48fbce-4c79-415a-aeac-4e3e872724ae","resolution":{"observed_at":"2026-08-07T12:33:12.258432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:12.383675Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:12.383675Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:eb7336cca749f8a16f60c50fe81039f2eefc9848f556f5a710e54d5a0e1fe5fa","observation_id":"c618bb1f-9378-4f4e-a8e8-05ca272c661b","resolution":{"observed_at":"2026-08-07T12:33:12.383675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-07T12:33:12.448500Z","title":"Limo: Less is more for reasoning.arXiv preprint arXiv:2502.03387, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:12.448500Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:9d19cdf8d803edef9aa74cfbbfb6cbe1c91d5dae286866d4038db1b2769b718b","observation_id":"ed50d571-49f4-4efd-a3c0-5fc29315c7a7","resolution":{"observed_at":"2026-08-07T12:33:12.448500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:12.557605Z","title":"Hallucidoctor: Mitigating hallucinatory toxicity in visual instruction data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:12.557605Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:7381d366b14ca27bff422dea5b5a1b226799f5f64cd0193b1365b5908b2fd292","observation_id":"3cb4a8e8-4452-4317-ac9e-074e4f911ef1","resolution":{"observed_at":"2026-08-07T12:33:12.557605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T12:33:12.653152Z","title":"Dapo: An open-source llm reinforcement learning system at scale.arXiv preprint arXiv:2503.14476, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:12.653152Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:4497279d17293cb877644fd06df8420c975dcfeba783fe087c468f2cfc828e62","observation_id":"9d8616b4-cc9f-478c-83fe-fa1433f61ea9","resolution":{"observed_at":"2026-08-07T12:33:12.653152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:12.750492Z","title":"Rlhf-v: Towards trustworthy mllms via behavior alignment from fine-grained correctional human feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:12.750492Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:8037836870414bb4111d9006233d04b479cc4c328ca27c674ac81ffba3582674","observation_id":"0f2fb295-f912-4fbd-8059-15d7e34eb919","resolution":{"observed_at":"2026-08-07T12:33:12.750492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02884","last_updated":"2024-11-21T07:07:59Z","snapshot_observed_at":"2026-08-07T12:03:21.367108Z","submitted_at":"2024-10-03T18:12:29Z","title":"LLaMA-Berry: Pairwise Optimization for O1-like Olympiad-Level Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02884","snapshot_observed_at":"2026-08-07T12:33:12.857251Z","title":"Llama-berry: Pairwise optimization for o1-like olympiad-level mathematical reasoning.arXiv preprint arXiv:2410.02884, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:12.857251Z"},"links":{"cited_paper":"/paper/2410.02884","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:b9b8b40146c37d989f47c240fb176b702551ad456b338389f07c2b45de3cb608","observation_id":"9ebaadc9-87c8-41a0-ba69-f23f61aa0c81","resolution":{"observed_at":"2026-08-07T12:33:12.857251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:15.318574Z","title":"Reflective instruction tuning: Mitigating hallucinations in large vision-language models","venue":null,"work_id":"74323fb2-9c31-4f60-9fce-18cb4852c6a9","year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:12.980715Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:7a4fa5a4710ac718312a21378dc3bdee338875a9233d8e88e8c1cd85d769392f","observation_id":"5e0dc656-f057-48a7-a72b-70435f63512d","resolution":{"observed_at":"2026-08-07T12:33:15.380205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:13.073898Z","title":"Mathverse: Does your multi-modal llm truly see the diagrams in visual math problems? InEuropean Conference on Computer Vision, pages 169–186","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:13.073898Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:f0b332a4ed50666523b0d2cbfbb43a2b36253f8e8be7e71c9a5469ea3f99117f","observation_id":"5a298254-9648-4782-abb3-752e69622b8f","resolution":{"observed_at":"2026-08-07T12:33:13.073898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11919","last_updated":"2024-11-28T13:35:56Z","snapshot_observed_at":"2026-07-06T19:52:11.774784Z","submitted_at":"2024-11-18T04:06:04Z","title":"VL-Uncertainty: Detecting Hallucination in Large Vision-Language Model via Uncertainty Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11919","snapshot_observed_at":"2026-08-07T12:33:13.190579Z","title":"Vl-uncertainty: Detecting hallucination in large vision-language model via uncertainty estimation.arXiv preprint arXiv:2411.11919, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:13.190579Z"},"links":{"cited_paper":"/paper/2411.11919","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:46b5bc320c968c7f9b3689de2592dda0155ad540492dbfedd84faaaf2d9df155","observation_id":"140db751-7cb8-4809-9e30-2e832334feb1","resolution":{"observed_at":"2026-08-07T12:33:13.190579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07301","last_updated":"2025-06-05T16:34:24Z","snapshot_observed_at":"2026-08-03T11:11:25.359494Z","submitted_at":"2025-01-13T13:10:16Z","title":"The Lessons of Developing Process Reward Models in Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07301","snapshot_observed_at":"2026-08-07T12:33:13.281932Z","title":"The lessons of developing process reward models in mathematical reasoning.arXiv preprint arXiv:2501.07301, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:13.281932Z"},"links":{"cited_paper":"/paper/2501.07301","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:d848e17b4fc93c4396557907c8592594d1b35bcda5e3e9f2b4d4f79295fb1cde","observation_id":"334b295f-408d-44bd-8026-aa20d981a015","resolution":{"observed_at":"2026-08-07T12:33:13.281932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:13.378434Z","title":"Multimodal chain-of-thought reasoning in language models.Transactions on Machine Learning Research","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:13.378434Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:329d2ea42a13623983a582aaf40dadaa965f6c6935ef7cb591f2154076af7da5","observation_id":"5fd38f61-18d5-478f-b822-1218dce4fd63","resolution":{"observed_at":"2026-08-07T12:33:13.378434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16839","last_updated":"2024-02-06T16:43:31Z","snapshot_observed_at":"2026-08-08T04:17:23.797697Z","submitted_at":"2023-11-28T14:54:37Z","title":"Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16839","snapshot_observed_at":"2026-08-07T12:33:13.470889Z","title":"Beyond hallucinations: Enhancing lvlms through hallucination-aware direct preference optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:13.470889Z"},"links":{"cited_paper":"/paper/2311.16839","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:b83b30a73d046c6e7610f1de798de5ab138ef44c82474b8105d358510cdcc3d4","observation_id":"daedcae0-b3a7-437e-b406-b2b3c87dc327","resolution":{"observed_at":"2026-08-07T12:33:13.470889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:15.136333Z","title":"A picture is worth a graph: A blueprint debate paradigm for multimodal reasoning","venue":null,"work_id":"8d2a7e63-2ecb-41ba-a1d9-0413839af48f","year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:13.563966Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:df3777d4acbffdc0dcd44d900ebbc640c09e958bbd537eef99dad43526579f62","observation_id":"cfacc5c1-dfc2-4639-8b13-4af198dd8327","resolution":{"observed_at":"2026-08-07T12:33:15.196268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12591","last_updated":"2024-11-15T21:01:37Z","snapshot_observed_at":"2026-07-06T19:52:37.903769Z","submitted_at":"2024-11-15T21:01:37Z","title":"Thinking Before Looking: Improving Multimodal LLM Reasoning via Mitigating Visual Hallucination","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12591","snapshot_observed_at":"2026-08-07T12:33:13.663322Z","title":"Thinking before looking: Improving multimodal llm reasoning via mitigating visual hallucination.arXiv preprint arXiv:2411.12591, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:13.663322Z"},"links":{"cited_paper":"/paper/2411.12591","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:dc6f8aeee95e93b9a578e69af1b87aad44bb8a28c82364e616581c4c4aaae532","observation_id":"7f35f66e-4cbe-463e-a511-e8f97f085ad1","resolution":{"observed_at":"2026-08-07T12:33:13.663322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:14.975232Z","title":"Relying on the unreliable: The impact of language models’ reluctance to express uncertainty","venue":null,"work_id":"67b086cf-5d1d-4470-a1d2-b1ea5100d000","year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:13.747662Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:c0e5af1be3e29ecb2a60034fa8d6503f95a43f9a61441b59c7c99ebaed878a41","observation_id":"0db258ac-a6f2-4765-b849-f5e6ecfc0fd7","resolution":{"observed_at":"2026-08-07T12:33:15.038180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:14.828375Z","title":"the answer is [answer in the input]","venue":null,"work_id":"8972c6af-36e2-4cac-9bb5-d82166ec43a4","year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:13.820971Z"},"links":{"citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:8acb6a56349822e8dc2e889a60598cab0dc6798dbf147de3bb8c1243a81ac58f","observation_id":"0d179a1e-f3fd-41b8-a842-23e070afc6e7","resolution":{"observed_at":"2026-08-07T12:33:14.881658Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM"},"reference_resolution":{"displayed":87,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":87},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 87 of 87 outbound references and 4 inbound Pith citation observations for arXiv:2505.24238."}