{"as_of":"2026-08-22T13:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c173a0668566b4f55b5556f6bd68c2719356f474c3a397b6b879151458637aac","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:53:11.881661Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":68,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:39:41.133050Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-12T13:41:49.762335Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16044","last_updated":"2025-09-01T02:39:51Z","snapshot_observed_at":"2026-08-15T05:00:23.895770Z","submitted_at":"2024-11-25T02:15:30Z","title":"ZoomEye: Enhancing Multimodal LLMs with Human-Like Zooming Capabilities through Tree-Based Image Exploration","version":4},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T13:41:49.762335Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2411.16044"},"observation_digest":"sha256:90c8ebe6bbeb46d5eeb60997f836ab2f263a070d479dc6e02948ddd1a41271c7","observation_id":"b10fc253-f090-4bb4-b52a-9276718d1b17","resolution":{"observed_at":"2026-08-12T13:41:49.762335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-11T14:00:26.830532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12567","last_updated":"2025-05-30T02:28:44Z","snapshot_observed_at":"2026-08-19T11:43:59.293306Z","submitted_at":"2024-12-17T05:50:55Z","title":"FCMR: Robust Evaluation of Financial Cross-Modal Multi-Hop Reasoning","version":4},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T14:00:26.830532Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2412.12567"},"observation_digest":"sha256:25e003ded436373ec0fb8154dca371939905e8882296d584937034a6ceaf2284","observation_id":"ad423973-0710-4592-aede-ac1814388c2f","resolution":{"observed_at":"2026-08-11T14:00:26.830532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-08-15T17:19:59.096854Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-13T17:36:27.515468Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2501.05366"},"observation_digest":"sha256:c0e80a43347b0e033b9e900435664739b884463918ef37334b21b3cb37991d7d","observation_id":"b580e726-7449-4b26-bbf6-24935a0bd077","resolution":{"observed_at":"2026-05-13T17:36:27.624658Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-10T19:27:23.501890Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10069","last_updated":"2025-04-27T08:55:07Z","snapshot_observed_at":"2026-08-16T23:17:00.237807Z","submitted_at":"2025-01-17T09:42:48Z","title":"A Survey on LLM Test-Time Compute via Search: Tasks, LLM Profiling, Search Algorithms, and Relevant Frameworks","version":4},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-10T19:27:23.501890Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2501.10069"},"observation_digest":"sha256:7586ba72cd5a0c39829e84d1722a9adf29ec0b8269a30c955f48fec1a5b86d89","observation_id":"0c1bcde0-415f-47b3-a589-c2117be0ae93","resolution":{"observed_at":"2026-08-10T19:27:23.501890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-10T17:09:06.849411Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12570","last_updated":"2025-01-29T03:11:03Z","snapshot_observed_at":"2026-08-18T10:17:24.497798Z","submitted_at":"2025-01-22T01:35:11Z","title":"O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T17:09:06.849411Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2501.12570"},"observation_digest":"sha256:667629a3adcd85ad4754724e3848291f0f9781455de352d48120959d2b806e22","observation_id":"23c6a007-5724-4046-9993-79b620aaf323","resolution":{"observed_at":"2026-08-10T17:09:06.849411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2502.02871","last_updated":"2026-04-20T02:18:01Z","snapshot_observed_at":"2026-08-17T11:21:07.508926Z","submitted_at":"2025-02-05T04:05:27Z","title":"Position: Multimodal Large Language Models Can Significantly Advance Scientific Reasoning","version":2},"reference_index":235,"source":"arxiv_source","source_observed_at":"2026-05-23T04:30:38.804702Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2502.02871"},"observation_digest":"sha256:7c8484eb91c023de6f2fc4ba9e5024641c559af3074d53ed928c1850c7893d1d","observation_id":"2445863c-5c1f-4b83-836c-443a5ad29832","resolution":{"observed_at":"2026-05-23T04:32:32.914733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2502.17419","last_updated":"2025-06-25T02:24:46Z","snapshot_observed_at":"2026-08-20T08:13:05.630967Z","submitted_at":"2025-02-24T18:50:52Z","title":"From System 1 to System 2: A Survey of Reasoning Large Language Models","version":6},"reference_index":234,"source":"pdf_text","source_observed_at":"2026-05-13T01:36:23.845366Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2502.17419"},"observation_digest":"sha256:d4c87f37bb4c5cf00a2dc83d5cfa6c473440e1fadaa2ed98640be1420e5d4e93","observation_id":"05e96a44-673c-498a-9e44-a5c222bd5e75","resolution":{"observed_at":"2026-05-13T01:36:24.386960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-08-18T16:51:32.000170Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-16T15:15:46.255296Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2503.07536"},"observation_digest":"sha256:fcf97bd4aa14a10b7885f7e59b3e5f39ce225d12d422d932e3d828bf19e8b142","observation_id":"0168748b-34d2-4f34-931e-69076eab310a","resolution":{"observed_at":"2026-05-16T15:15:46.332540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-15T09:44:57.157415Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T00:19:20.462455Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2503.10615"},"observation_digest":"sha256:670357220cc6897a6b05dbbfe1bce79bdad88b500461e9d3b6a64dea90d0280f","observation_id":"f0a57240-9dbe-4dc8-9a2c-892def0145cc","resolution":{"observed_at":"2026-05-16T00:19:20.521597Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2503.12605","last_updated":"2025-03-23T13:47:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-16T18:39:13Z","title":"Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-15T17:18:52.996467Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2503.12605"},"observation_digest":"sha256:49c1f2bb3743a6b065fcd44c3072c459471273930244f4f397c21c0e79e4aa07","observation_id":"c6be422e-5438-4bd1-af12-e449029a4a2a","resolution":{"observed_at":"2026-05-15T17:18:53.762696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2503.12937","last_updated":"2025-08-04T04:22:09Z","snapshot_observed_at":"2026-08-13T01:30:54.104133Z","submitted_at":"2025-03-17T08:51:44Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T15:04:22.690503Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2503.12937"},"observation_digest":"sha256:89ddde9c5089eb1e03c45c2228152d61e1e2fd8730d77a5651e64150623905fe","observation_id":"8b2e5172-eb26-4aab-bb35-1dfb5b7b0bde","resolution":{"observed_at":"2026-05-16T15:04:22.772654Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2503.17352","last_updated":"2025-11-11T08:13:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-21T17:52:43Z","title":"OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-19T06:59:03.112252Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2503.17352"},"observation_digest":"sha256:c786bda59ec7898b34404c3f54a5d4cd01b5f3ca18f8242a61724f4d6313f6bc","observation_id":"e845a83c-c550-4af2-8f1d-78b2529bbb72","resolution":{"observed_at":"2026-05-19T06:59:03.316807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2504.09925","last_updated":"2026-04-29T06:12:36Z","snapshot_observed_at":"2026-08-16T10:58:08.667292Z","submitted_at":"2025-04-14T06:33:29Z","title":"FLARE: Fully Integration of Vision-Language Representations for Deep Cross-Modal Understanding","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-22T19:49:00.961388Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2504.09925"},"observation_digest":"sha256:73c2368556326b2fa7c8dc139103f8ad06feef8173ac7ab9790e156a0ad88870","observation_id":"b12f219c-6aff-409e-9b29-c0416c8f240e","resolution":{"observed_at":"2026-05-22T19:52:01.898750Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-16T05:39:41.133050Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20199","last_updated":"2025-04-28T19:02:18Z","snapshot_observed_at":"2026-08-20T18:59:34.719925Z","submitted_at":"2025-04-28T19:02:18Z","title":"Weaving Context Across Images: Improving Vision-Language Models through Focus-Centric Visual Chains","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T05:39:41.133050Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2504.20199"},"observation_digest":"sha256:368eb460ec9d938f693c1f41fe8cd1c9054f6fbeca064a2668b33b4b9983ce21","observation_id":"0502a755-aa09-4b7f-8a9a-8768539c88f2","resolution":{"observed_at":"2026-08-16T05:39:41.133050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-16T05:12:18.654182Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21277","last_updated":"2025-05-21T06:08:31Z","snapshot_observed_at":"2026-08-21T11:45:05.225710Z","submitted_at":"2025-04-30T03:14:28Z","title":"Reinforced MLLM: A Survey on RL-Based Reasoning in Multimodal Large Language Models","version":2},"reference_index":130,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:18.654182Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2504.21277"},"observation_digest":"sha256:9424dad29e2a91171cffe3846af285560ca020772fa9ab027d5d66755f437cb3","observation_id":"61adf9fe-006a-4855-b3de-58f0b2a44cfd","resolution":{"observed_at":"2026-08-16T05:12:18.654182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-16T00:48:19.665826Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02665","last_updated":"2025-05-08T05:27:18Z","snapshot_observed_at":"2026-08-18T12:36:55.051772Z","submitted_at":"2025-05-05T14:14:59Z","title":"A Survey of Slow Thinking-based Reasoning LLMs using Reinforced Learning and Inference-time Scaling Law","version":2},"reference_index":142,"source":"pdf_text","source_observed_at":"2026-08-16T00:48:19.665826Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.02665"},"observation_digest":"sha256:b13671cbb4ce409f640031fef9be368e6e159952f50d916f4d2c56a52477e469","observation_id":"ff77fb0c-e3ed-4bc3-b77b-f2eaaa223465","resolution":{"observed_at":"2026-08-16T00:48:19.665826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T15:34:55.877402Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14682","last_updated":"2025-05-20T17:59:26Z","snapshot_observed_at":"2026-08-13T02:57:53.245907Z","submitted_at":"2025-05-20T17:59:26Z","title":"UniGen: Enhanced Training & Test-Time Strategies for Unified Multimodal Understanding and Generation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:55.877402Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.14682"},"observation_digest":"sha256:c37a3b4b4066c7605779c5b951959f93adfb9b3a03dae15874a6b5e7c9f9f96f","observation_id":"5fb6049a-a965-430f-a92e-3813bd5b6a78","resolution":{"observed_at":"2026-08-07T15:34:55.877402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T15:13:52.634235Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-19T03:09:18.275447Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:52.634235Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:d3a1296991d8cecf6807813e954f14678bca7bd9a8c2690bfa4db30b536654fb","observation_id":"9d634656-5c72-4ccb-9890-89369531f8f8","resolution":{"observed_at":"2026-08-07T15:13:52.634235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T15:01:34.575094Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16673","last_updated":"2025-05-22T13:39:32Z","snapshot_observed_at":"2026-08-21T21:57:28.777352Z","submitted_at":"2025-05-22T13:39:32Z","title":"R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:01:34.575094Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.16673"},"observation_digest":"sha256:4a0c62286e42e82672d7428d9b751cc31f734d353cc1aad09956d69db0fba719","observation_id":"90baaafb-bf9e-450e-bf43-6004bb7b83b6","resolution":{"observed_at":"2026-08-07T15:01:34.575094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T14:31:14.568519Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18536","last_updated":"2025-05-24T06:01:48Z","snapshot_observed_at":"2026-08-16T23:13:31.947741Z","submitted_at":"2025-05-24T06:01:48Z","title":"Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:31:14.568519Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.18536"},"observation_digest":"sha256:e7a04d7d8d632294546a45e251660a5e4243789d008163ab1bb890b1cf15fd15","observation_id":"9ecc574c-ada4-42b0-9d5d-6131135f8e9a","resolution":{"observed_at":"2026-08-07T14:31:14.568519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T14:19:04.371188Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19406","last_updated":"2025-05-26T01:42:38Z","snapshot_observed_at":"2026-08-18T14:27:41.645717Z","submitted_at":"2025-05-26T01:42:38Z","title":"Unveiling the Compositional Ability Gap in Vision-Language Reasoning Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:19:04.371188Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.19406"},"observation_digest":"sha256:da88afbc7e5b308381267bef0d1b04e3fefb890c08d1533ec9b2f80f729516c4","observation_id":"47598c7c-5742-4d49-b975-a4a009bdb9c0","resolution":{"observed_at":"2026-08-07T14:19:04.371188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T13:36:01.466524Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21327","last_updated":"2025-05-27T15:23:23Z","snapshot_observed_at":"2026-08-20T06:11:48.391709Z","submitted_at":"2025-05-27T15:23:23Z","title":"MME-Reasoning: A Comprehensive Benchmark for Logical Reasoning in MLLMs","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T13:36:01.466524Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.21327"},"observation_digest":"sha256:771ffb3b04b9c216b2b3af3537058759af1151d0343aa3dd106ad920159c5349","observation_id":"73db5779-c516-4837-9876-314466996ab7","resolution":{"observed_at":"2026-08-07T13:36:01.466524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T14:51:35.946043Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21523","last_updated":"2025-06-20T08:41:41Z","snapshot_observed_at":"2026-08-21T04:36:23.436302Z","submitted_at":"2025-05-23T05:08:40Z","title":"More Thinking, Less Seeing? Assessing Amplified Hallucination in Multimodal Reasoning Models","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.946043Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.21523"},"observation_digest":"sha256:2e8495f02e623b7f0219ec4c96adf3469cd74e3440095b127d8521a1ce10fc95","observation_id":"daa75c69-f23d-4a59-a3ab-8ab7d728b3e0","resolution":{"observed_at":"2026-08-07T14:51:35.946043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T13:12:58.218444Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22334","last_updated":"2025-07-23T07:37:08Z","snapshot_observed_at":"2026-08-18T08:49:01.935048Z","submitted_at":"2025-05-28T13:21:38Z","title":"Advancing Multimodal Reasoning via Reinforcement Learning with Cold Start","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:58.218444Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.22334"},"observation_digest":"sha256:121b87921e3436b5be08815ed02da057c53b60fa479223f381ba094799123ac0","observation_id":"c410146c-2b0d-4cf1-9aec-ba6358eaa55b","resolution":{"observed_at":"2026-08-07T13:12:58.218444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T12:59:22.779575Z","title":"Huang, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-16T08:04:58.307699Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:22.779575Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:5db4d3598298bd6add95f31845ccbf8d7ebfa86594e90bc1a7231f21aab817d3","observation_id":"3e0959b3-67cf-4dbc-b435-144b138447c1","resolution":{"observed_at":"2026-08-07T12:59:22.779575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2505.23678","last_updated":"2026-05-15T17:27:46Z","snapshot_observed_at":"2026-08-15T11:40:43.216223Z","submitted_at":"2025-05-29T17:20:26Z","title":"Grounded Reinforcement Learning for Visual Reasoning","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-22T01:05:18.801388Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.23678"},"observation_digest":"sha256:aa16ee2f7e0ae726d2f074c2586fd974129bfe9252a83944e26c0cd13df5e9bd","observation_id":"78b947a2-9833-44fc-9df2-237ae3597012","resolution":{"observed_at":"2026-05-22T01:05:52.100628Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T12:33:12.258432Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-17T05:22:52.210760Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:12.258432Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:87d21ab91e049a8ffff67abea1b6fab2e6b7d8bb0ebe72b16549d3b43bc238bb","observation_id":"0b48fbce-4c79-415a-aeac-4e3e872724ae","resolution":{"observed_at":"2026-08-07T12:33:12.258432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T11:55:14.280040Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01078","last_updated":"2025-06-01T16:28:26Z","snapshot_observed_at":"2026-08-21T17:42:03.698763Z","submitted_at":"2025-06-01T16:28:26Z","title":"GThinker: Towards General Multimodal Reasoning via Cue-Guided Rethinking","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:14.280040Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.01078"},"observation_digest":"sha256:505cd914295afed54f3911d6cf1a5cabef8fcd4b7808658050a187bc16620509","observation_id":"126c7a05-0e26-4e47-af71-db622ff377b7","resolution":{"observed_at":"2026-08-07T11:55:14.280040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T11:40:55.873734Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01725","last_updated":"2025-06-02T14:30:09Z","snapshot_observed_at":"2026-08-15T09:52:26.987289Z","submitted_at":"2025-06-02T14:30:09Z","title":"VideoCap-R1: Enhancing MLLMs for Video Captioning via Structured Thinking","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:55.873734Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.01725"},"observation_digest":"sha256:ad0bbac765ca2b7040f1dd55e555778b68b22059dce906a87d8f78574ca63495","observation_id":"11382a79-e212-483d-acee-0e4633d8e18a","resolution":{"observed_at":"2026-08-07T11:40:55.873734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T11:35:47.633710Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-16T21:01:21.497825Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.633710Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:5a3acf2ff376334eb9c8064277c6cb2766a2dbe5080b880f82b3852412bcd2a3","observation_id":"e11d0494-ee93-48e0-b805-ec5b346c0859","resolution":{"observed_at":"2026-08-07T11:35:47.633710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T10:28:53.914971Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05331","last_updated":"2025-06-05T17:59:02Z","snapshot_observed_at":"2026-08-16T07:14:23.993847Z","submitted_at":"2025-06-05T17:59:02Z","title":"MINT-CoT: Enabling Interleaved Visual Tokens in Mathematical Chain-of-Thought Reasoning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.914971Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.05331"},"observation_digest":"sha256:086ad07024cd220333ffcb6f5cac60f77533808c2b43b21d33e107baa7b478c9","observation_id":"45f4b524-8bd6-478b-9f8e-112eb596ffea","resolution":{"observed_at":"2026-08-07T10:28:53.914971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T06:01:49.661304Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.661304Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:4fe616e763d18e668f357e7ffe78ca56c4bd75c0d9fb7c8762a5e26fde544a81","observation_id":"eb26364b-9673-4dc3-92d1-342ae56409e4","resolution":{"observed_at":"2026-08-07T06:01:49.661304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T05:01:20.446667Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08927","last_updated":"2025-06-10T15:51:16Z","snapshot_observed_at":"2026-08-16T18:49:11.556043Z","submitted_at":"2025-06-10T15:51:16Z","title":"Socratic-MCTS: Test-Time Visual Reasoning by Asking the Right Questions","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:01:20.446667Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.08927"},"observation_digest":"sha256:b2d2e0aa0ef22f800e63faa78fc9b23afba4c8aae2b6c2440c63f54e810f3d03","observation_id":"087b4ef5-85d7-4553-bb5f-ca2c6e4f167e","resolution":{"observed_at":"2026-08-07T05:01:20.446667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T04:07:34.668498Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11571","last_updated":"2025-07-18T08:23:14Z","snapshot_observed_at":"2026-08-19T09:43:05.217958Z","submitted_at":"2025-06-13T08:27:45Z","title":"VFaith: Do Large Multimodal Models Really Reason on Seen Images Rather than Previous Memories?","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:07:34.668498Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.11571"},"observation_digest":"sha256:c967060036b4e62eb684818d12e1d6897634aa154c38688635e97ec6b5fb93ff","observation_id":"f848019f-2edc-47ec-a455-f1c34aded2ed","resolution":{"observed_at":"2026-08-07T04:07:34.668498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T00:13:38.425045Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14907","last_updated":"2025-06-17T18:25:56Z","snapshot_observed_at":"2026-08-18T19:23:57.125565Z","submitted_at":"2025-06-17T18:25:56Z","title":"PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:38.425045Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.14907"},"observation_digest":"sha256:f15f6955006c15f28af92de327652f1445798f4cd56a202558a450284eeda616","observation_id":"7dcb0f31-3bf2-4cea-bf6c-bd8fbc64ad49","resolution":{"observed_at":"2026-08-07T00:13:38.425045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-06T22:29:28.485026Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21655","last_updated":"2025-06-26T17:57:08Z","snapshot_observed_at":"2026-08-14T21:07:06.019881Z","submitted_at":"2025-06-26T17:57:08Z","title":"APO: Enhancing Reasoning Ability of MLLMs via Asymmetric Policy Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:29:28.485026Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.21655"},"observation_digest":"sha256:a4126bd76020adab9a158ee4adaf392d31a82bdb2a9e34585e95b6426f8231bf","observation_id":"ee98e613-7690-4797-9504-94d2f83e0d75","resolution":{"observed_at":"2026-08-06T22:29:28.485026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-06T21:41:40.304579Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23563","last_updated":"2025-06-30T07:14:38Z","snapshot_observed_at":"2026-08-20T11:17:49.263799Z","submitted_at":"2025-06-30T07:14:38Z","title":"MMReason: An Open-Ended Multi-Modal Multi-Step Reasoning Benchmark for MLLMs Toward AGI","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:41:40.304579Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.23563"},"observation_digest":"sha256:16c7c22261722851e591d7666fab5a13f74fdf4e1d2d7d1810921731b8f8a527","observation_id":"fec71ebb-790b-405a-aa09-33befdc3f34a","resolution":{"observed_at":"2026-08-06T21:41:40.304579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-06T20:25:24.323882Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02804","last_updated":"2026-06-28T12:40:31Z","snapshot_observed_at":"2026-08-14T10:49:37.621647Z","submitted_at":"2025-07-03T17:07:20Z","title":"Multimodal Mathematical Reasoning with Diverse Solving Perspective","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T20:25:24.323882Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2507.02804"},"observation_digest":"sha256:de722447de1658c038d762617c4d0c8234a3c4c89928c905df37d3ee3f56f616","observation_id":"4dd3c650-550b-4868-80f4-384c5615805b","resolution":{"observed_at":"2026-08-06T20:25:24.323882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-06T21:22:27.289983Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02978","last_updated":"2025-07-01T03:05:56Z","snapshot_observed_at":"2026-08-19T10:23:06.669048Z","submitted_at":"2025-07-01T03:05:56Z","title":"Ascending the Infinite Ladder: Benchmarking Spatial Deformation Reasoning in Vision-Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T21:22:27.289983Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2507.02978"},"observation_digest":"sha256:cc170dcfad8a55253ffbb995c77754c855bf1c8b74ee7bdff3895320593caec4","observation_id":"2d984caf-423b-429f-a797-ea9f406ecd3e","resolution":{"observed_at":"2026-08-06T21:22:27.289983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-06T18:04:55.194413Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09374","last_updated":"2025-07-12T18:44:32Z","snapshot_observed_at":"2026-08-17T20:53:14.310586Z","submitted_at":"2025-07-12T18:44:32Z","title":"EduFlow: Advancing MLLMs' Problem-Solving Proficiency through Multi-Stage, Multi-Perspective Critique","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T18:04:55.194413Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2507.09374"},"observation_digest":"sha256:4f0f2921ca1c67e7284286e27c654731e9c8e1a57815ec60c5bac3a7f8c375c0","observation_id":"fb6c8088-67a7-449e-a9d4-7d72bc5773c8","resolution":{"observed_at":"2026-08-06T18:04:55.194413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-06T16:34:00.236317Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13348","last_updated":"2025-07-17T17:59:55Z","snapshot_observed_at":"2026-08-19T03:39:30.749912Z","submitted_at":"2025-07-17T17:59:55Z","title":"VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T16:34:00.236317Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2507.13348"},"observation_digest":"sha256:2e081c07fda2069115926aecb427485698555a8d420c163dc8a3d2e80b6de468","observation_id":"4a463d6b-3352-4a14-aa1c-214b488ba78f","resolution":{"observed_at":"2026-08-06T16:34:00.236317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-06T11:35:17.014678Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-13T02:58:31.453226Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:17.014678Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:8580fefc61bc9240d96047229d6b1133ee791003c2cf656e96ba295c33b5d9bb","observation_id":"9e9f9bd2-7984-4338-86fd-750d3c07a831","resolution":{"observed_at":"2026-08-06T11:35:17.014678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-06T00:59:43.431479Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03986","last_updated":"2025-08-06T00:39:28Z","snapshot_observed_at":"2026-08-17T20:24:30.316374Z","submitted_at":"2025-08-06T00:39:28Z","title":"The Emotional Baby Is Truly Deadly: Does your Multimodal Large Reasoning Model Have Emotional Flattery towards Humans?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T00:59:43.431479Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2508.03986"},"observation_digest":"sha256:4b04207fc1f4f49776930327c95d0c6d79775291192d2e3432fd517974de8286","observation_id":"cca519d0-326f-488d-8942-db1710d26895","resolution":{"observed_at":"2026-08-06T00:59:43.431479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T10:39:02.195906Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-17T17:37:38.616375Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:02.195906Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:9bdcc995196e2389903def4db9cd3a7403a29c2dfe5f2727f9be896788dadd93","observation_id":"22b6c7f7-abb2-4156-85da-64c777a29856","resolution":{"observed_at":"2026-08-05T10:39:02.195906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-04T18:49:39.220967Z","title":"arXiv preprint arXiv:2412.18319 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09658","last_updated":"2026-05-25T08:56:37Z","snapshot_observed_at":"2026-08-19T11:51:13.506197Z","submitted_at":"2025-09-11T17:54:00Z","title":"Measuring Epistemic Humility in Multimodal Large Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T18:49:39.220967Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2509.09658"},"observation_digest":"sha256:ea70e860f6e91f9fd9a1edac4979018023b7da7ff55b16e788a5cb683314604c","observation_id":"4d257517-7fcc-4fae-ba0e-77b5f9c88cd8","resolution":{"observed_at":"2026-08-04T18:49:39.220967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2509.22746","last_updated":"2026-05-14T08:41:49Z","snapshot_observed_at":"2026-08-16T19:08:04.267269Z","submitted_at":"2025-09-26T04:33:53Z","title":"Mixture-of-Visual-Thoughts: Exploring Context-Adaptive Reasoning Mode Selection for General Visual Reasoning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-18T13:33:12.508639Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2509.22746"},"observation_digest":"sha256:e3f517d01e4ce7f8ac52f095b3db3e448ca11fe1c3bad37c9ea2fc45aba18b4c","observation_id":"1901e20f-0587-4281-904a-fc08c4dbeab0","resolution":{"observed_at":"2026-05-18T13:36:25.218707Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2510.14738","last_updated":"2026-04-18T22:41:52Z","snapshot_observed_at":"2026-08-21T04:21:49.768743Z","submitted_at":"2025-10-16T14:40:02Z","title":"AutoRubric: Rubric-Based Generative Rewards for Faithful Multimodal Reasoning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T06:22:51.194258Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2510.14738"},"observation_digest":"sha256:7ff82a9dad805f4554516b27d0abb45646ce114f04f16fd38119b28d039cdfcb","observation_id":"dcb294ac-1729-4a20-957a-1b69187f1710","resolution":{"observed_at":"2026-05-18T06:25:58.662923Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-03T22:19:23.737176Z","title":"Mulberry: Empow- ering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.11132","last_updated":"2026-07-14T03:06:56Z","snapshot_observed_at":"2026-08-13T09:24:34.444419Z","submitted_at":"2025-11-14T10:03:23Z","title":"From Hindsight to Foresight: Self-Encouraged Hindsight Distillation for Knowledge-based Visual Question Answering","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T22:19:23.737176Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2511.11132"},"observation_digest":"sha256:2b6696a2758ddf4da097a82249035632ef1a3da879d6ac84865bf3d942ee57b9","observation_id":"eeae1f07-b5ad-4c89-b6b7-b8cbdaed8421","resolution":{"observed_at":"2026-08-03T22:19:23.737176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-03T19:04:28.472931Z","title":"Mulberry: Empowering mllm with o1- like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.02456","last_updated":"2026-06-29T04:23:52Z","snapshot_observed_at":"2026-08-16T13:20:01.556189Z","submitted_at":"2025-12-02T06:30:10Z","title":"See, Think, Learn: A Self-Taught Multimodal Reasoner","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T19:04:28.472931Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2512.02456"},"observation_digest":"sha256:c1b9dd38d54a282ebde8db980f98854c32fee04923d1661f0e12ceca4b068b0d","observation_id":"a6e8d204-9495-40ae-8eeb-3eef15c4d873","resolution":{"observed_at":"2026-08-03T19:04:28.472931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-03T17:15:17.705468Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10414","last_updated":"2026-05-30T03:42:16Z","snapshot_observed_at":"2026-08-15T18:36:58.856582Z","submitted_at":"2025-12-11T08:27:02Z","title":"Boosting RL-Based Visual Reasoning with Selective Adversarial Entropy Intervention","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T17:15:17.705468Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2512.10414"},"observation_digest":"sha256:be3c66482bc75b48daadff366789ab80720d63664253869f5f4ffe2c0b1c4e11","observation_id":"ed8b0df9-e4fc-4c3e-b2b3-a98afd06df6f","resolution":{"observed_at":"2026-08-03T17:15:17.705468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:8bb351fab64ea91e6f23dfad6313c633245d4f367c8244b0c80d2d69c9612157","observation_id":"06be3bcc-8d74-4ced-b42d-4ba96826ed5f","resolution":{"observed_at":"2026-05-16T22:38:37.768730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-03T11:13:16.953162Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.07298","last_updated":"2026-06-21T08:39:33Z","snapshot_observed_at":"2026-08-08T14:41:26.174719Z","submitted_at":"2026-01-12T08:15:36Z","title":"Mimic Human Cognition, Master Multi-Image Reasoning: A Meta-Action Framework for Enhanced Visual Understanding","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-03T11:13:16.953162Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2601.07298"},"observation_digest":"sha256:bf00249eea1785b1248d184155935b09128cbbf53465f8efd4e9bc517b2d121e","observation_id":"85d50452-a5a5-40d9-a4a2-c57091229151","resolution":{"observed_at":"2026-08-03T11:13:16.953162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-07-14T23:22:13.847876Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.10757","last_updated":"2026-06-20T10:12:15Z","snapshot_observed_at":"2026-08-13T21:01:04.544839Z","submitted_at":"2026-03-11T13:32:58Z","title":"CodePercept: Code-Grounded Visual STEM Perception for MLLMs","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-14T23:22:13.847876Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2603.10757"},"observation_digest":"sha256:051b8f13851b6e9a0b99afcb3677ea33fb0e63f6218b07bc615e3a747a514a8b","observation_id":"2742394c-f1b6-4286-9112-e5884e5e2ce1","resolution":{"observed_at":"2026-07-14T23:22:13.847876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2604.03179","last_updated":"2026-04-03T16:56:34Z","snapshot_observed_at":"2026-08-20T10:38:41.392574Z","submitted_at":"2026-04-03T16:56:34Z","title":"Understanding the Role of Hallucination in Reinforcement Post-Training of Multimodal Reasoning Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T20:48:52.130130Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2604.03179"},"observation_digest":"sha256:2073c0f97e31a35350a4328aabe0bacf501b85fd6fe3d3c7871c1d76714ce617","observation_id":"872e0a96-19b6-4882-b7c2-c9591849c3dc","resolution":{"observed_at":"2026-05-13T20:53:16.233964Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2604.03318","last_updated":"2026-05-25T15:52:36Z","snapshot_observed_at":"2026-08-11T14:54:33.743148Z","submitted_at":"2026-04-01T15:28:13Z","title":"EgoMind: Activating Spatial Cognition through Linguistic Reasoning in MLLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T22:41:09.840792Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2604.03318"},"observation_digest":"sha256:e9a8442915c154c2708da51f3c85021304806bb0f860f55a43bb6c43ba4d25ce","observation_id":"2fe2d175-6bc3-4591-afde-d9e5046d62f7","resolution":{"observed_at":"2026-05-13T22:43:22.880169Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-07-13T14:39:55.177552Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03318","last_updated":"2026-05-25T15:52:36Z","snapshot_observed_at":"2026-08-11T14:54:33.743148Z","submitted_at":"2026-04-01T15:28:13Z","title":"EgoMind: Activating Spatial Cognition through Linguistic Reasoning in MLLMs","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-13T14:39:55.177552Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2604.03318"},"observation_digest":"sha256:101f6e6faf6a760c9147b9ed5143b79206c3c482ff513eeae5167d39b3ef036e","observation_id":"ef9652c7-9ee0-4bf7-90b9-b8bcf885574c","resolution":{"observed_at":"2026-07-13T14:39:55.177552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2604.04500","last_updated":"2026-04-06T07:51:59Z","snapshot_observed_at":"2026-08-13T02:16:47.977396Z","submitted_at":"2026-04-06T07:51:59Z","title":"Saliency-R1: Enforcing Interpretable and Faithful Vision-language Reasoning via Saliency-map Alignment Reward","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-10T19:59:19.379119Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2604.04500"},"observation_digest":"sha256:b3a5b876db32e89b639f9c9be5b94f38ec7e6a1c15e814d573250cff5d5c6acf","observation_id":"29ab38f9-d3ae-4998-8379-e10253f297d4","resolution":{"observed_at":"2026-05-10T22:20:47.814497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2604.24339","last_updated":"2026-04-27T11:31:15Z","snapshot_observed_at":"2026-07-06T23:10:24.992210Z","submitted_at":"2026-04-27T11:31:15Z","title":"See Further, Think Deeper: Advancing VLM's Reasoning Ability with Low-level Visual Cues and Reflection","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-08T04:46:16.497585Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2604.24339"},"observation_digest":"sha256:ac834a2efd37aedce97915a84f5299cf85d8fb68d44f2b002137fc640f13f3bc","observation_id":"b1f3277b-1dbf-4699-b405-70d78dc7fd39","resolution":{"observed_at":"2026-05-11T21:36:17.429128Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2605.04064","last_updated":"2026-04-10T21:13:46Z","snapshot_observed_at":"2026-08-11T04:56:00.431645Z","submitted_at":"2026-04-10T21:13:46Z","title":"Improving Medical VQA through Trajectory-Aware Process Supervision","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T17:18:17.846140Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2605.04064"},"observation_digest":"sha256:1bcb220e2583e72aa10b66ab72b4e26f9e18ac8eb3a0b7710588799b2307545e","observation_id":"fe21a0c5-c498-4073-81d0-d37b724abdfa","resolution":{"observed_at":"2026-05-11T07:06:06.106083Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2605.09614","last_updated":"2026-05-10T15:53:11Z","snapshot_observed_at":"2026-08-13T19:01:42.951240Z","submitted_at":"2026-05-10T15:53:11Z","title":"Reflection Anchors for Propagation-Aware Visual Retention in Long-Chain Multimodal Reasoning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T02:24:12.349405Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2605.09614"},"observation_digest":"sha256:1ca6362104fa0bc714ff560385532eb381b2c13cb4fbbad3f3dd909b543984d5","observation_id":"4d9b3300-e2e6-4d78-811f-73a3c07cdc0b","resolution":{"observed_at":"2026-05-12T07:41:26.743697Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2605.25571","last_updated":"2026-05-25T08:26:34Z","snapshot_observed_at":"2026-08-11T23:46:03.759864Z","submitted_at":"2026-05-25T08:26:34Z","title":"AnE: Pushing the Reasoning Frontier of Multimodal LLMs via Anchor Evolution","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T22:56:39.504430Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2605.25571"},"observation_digest":"sha256:cbcfb064e33037b0629de81f61bdf02f7303a1e4fc94d77af73efab50453dedf","observation_id":"eeb130d9-0f29-43d0-9bfd-e1f0120f3efb","resolution":{"observed_at":"2026-06-30T00:14:04.640763Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2606.08231","last_updated":"2026-06-06T15:39:29Z","snapshot_observed_at":"2026-08-07T16:58:05.550639Z","submitted_at":"2026-06-06T15:39:29Z","title":"Test-Time Scaling in Multimodal Foundation Models: A Comprehensive Survey of Generation and Reasoning","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-06-27T19:36:57.231932Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2606.08231"},"observation_digest":"sha256:d2b33283ba83bd507f8d6272de81c2e37a036145475b3a220c37ec53cd2acd83","observation_id":"ab338af3-4a90-4700-88a7-e8dd47e69556","resolution":{"observed_at":"2026-07-02T21:37:25.300780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2606.08464","last_updated":"2026-06-07T05:58:39Z","snapshot_observed_at":"2026-08-15T15:16:57.255291Z","submitted_at":"2026-06-07T05:58:39Z","title":"TVI-CoT: Text-Visual Interleaved Chain-of-Thought Reasoning for Multimodal Understanding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T18:54:34.353940Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2606.08464"},"observation_digest":"sha256:b1ea31a0efdd61a302c9c07f88397891aba1376b80e00f320d4231f0dac231e9","observation_id":"c315e3cf-a431-4d02-aa05-953eb9477c07","resolution":{"observed_at":"2026-07-02T22:27:25.919050Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2606.17888","last_updated":"2026-06-16T13:09:32Z","snapshot_observed_at":"2026-08-08T01:57:17.698279Z","submitted_at":"2026-06-16T13:09:32Z","title":"MathVis-Fine: Aligning Visual Supervision with Necessity via Progressive Dependency-Guided Training for Multimodal Mathematical Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-27T01:23:40.564561Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2606.17888"},"observation_digest":"sha256:ab3e7ba0968c85a203d81e63b5b59464eb0577de5c798ed5d0ef9a13f071fb04","observation_id":"d5c49abe-4f0d-4486-a1c8-496ccb92d828","resolution":{"observed_at":"2026-07-03T20:18:57.680997Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2606.22385","last_updated":"2026-06-21T08:22:23Z","snapshot_observed_at":"2026-08-01T18:23:09.613202Z","submitted_at":"2026-06-21T08:22:23Z","title":"MetaPS: Adaptive Programmatic Strategy Selection for Market Agents","version":1},"reference_index":122,"source":"arxiv_source","source_observed_at":"2026-06-26T11:06:28.690956Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2606.22385"},"observation_digest":"sha256:51cda17f765462ad71f4913b065d6a064a96c20f0d34ae430d16eee996a63408","observation_id":"73568d86-d25c-4e8c-b17b-b33d43b41570","resolution":{"observed_at":"2026-07-04T08:39:42.611122Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-07-12T09:29:14.105502Z","title":"arXiv preprint arXiv:2412.18319 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02592","last_updated":"2026-07-01T07:37:10Z","snapshot_observed_at":"2026-08-18T11:09:10.221848Z","submitted_at":"2026-07-01T07:37:10Z","title":"H-OPD: Confidence Aware Heterogeneous Multi-Teacher Multimodal On-policy Distillation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-12T09:29:14.105502Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2607.02592"},"observation_digest":"sha256:a2eeabeddd768071a0e770e9266970c0ce5485694cb35a6f21a1e300c8aa5009","observation_id":"53b5e208-032d-458c-91c4-6c7daec29b65","resolution":{"observed_at":"2026-07-12T09:29:14.105502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-07-11T21:09:01.431209Z","title":"arXiv preprint arXiv:2412.18319 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04179","last_updated":"2026-07-05T08:51:47Z","snapshot_observed_at":"2026-08-13T14:23:34.664037Z","submitted_at":"2026-07-05T08:51:47Z","title":"CritiqueDriveVLM: From Verifier-Guided Reinforcement Learning to Latent Thought Distillation for Autonomous Driving","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-11T21:09:01.431209Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2607.04179"},"observation_digest":"sha256:d26916f953f0dec9fccbf9ccf4211c2990f0f7c9c5a3da28061bc6534e9266eb","observation_id":"3fe60863-c310-4158-80a8-9a02861da75b","resolution":{"observed_at":"2026-07-11T21:09:01.431209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-07-14T01:07:06.861298Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10004","last_updated":"2026-07-10T22:03:01Z","snapshot_observed_at":"2026-08-14T20:11:04.127435Z","submitted_at":"2026-07-10T22:03:01Z","title":"Model Guides You How to Draw: Adaptive Visual Gating for Unified Multimodal Reasoning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T01:07:06.861298Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2607.10004"},"observation_digest":"sha256:adbd7120e65c6a5ce6a8bad94b133865846eaa008fde6cc823622a5c7df45af7","observation_id":"5e933b81-ad73-442f-8fe3-4765e11e0c6c","resolution":{"observed_at":"2026-07-14T01:07:06.861298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.18319/citation-record","integrity":"/paper/2412.18319/integrity","json":"/paper/2412.18319/citation-record.json","paper":"/paper/2412.18319"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.14432","last_updated":"2025-05-02T16:03:31Z","snapshot_observed_at":"2026-08-17T16:49:55.394145Z","submitted_at":"2024-11-21T18:59:55Z","title":"Insight-V: Exploring Long-Chain Visual Reasoning with Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14432","snapshot_observed_at":"2026-08-11T04:53:11.765441Z","title":"Insight-v: Exploring long-chain visual reasoning with multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.765441Z"},"links":{"cited_paper":"/paper/2411.14432","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:71d16c519b4e0e46f14733fe6c11e1eb3fa80daf16497ed5ff882c2c67f1ec93","observation_id":"81eb2a25-5998-4329-b68c-5ea524fe735c","resolution":{"observed_at":"2026-08-11T04:53:11.765441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-11T04:53:11.785803Z","title":"P., Perelman, A., Ramesh, A., Clark, A., Ostrow, A., Welihinda, A., Hayes, A., Radford, A., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.785803Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:e18700438b73fdb61c8e66ce73b5ea538eceb24febee7374ffe87391ba8edc63","observation_id":"1a9b162e-0f4c-4f29-8cd9-2ab06e06629c","resolution":{"observed_at":"2026-08-11T04:53:11.785803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.07300","last_updated":"2018-02-22T22:50:42Z","snapshot_observed_at":"2026-08-15T22:53:17.165603Z","submitted_at":"2017-10-19T18:01:38Z","title":"FigureQA: An Annotated Figure Dataset for Visual Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.07300","snapshot_observed_at":"2026-08-11T04:53:11.790199Z","title":"E., Michalski, V ., Atkinson, A., Kádár, Á., Trischler, A., and Bengio, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.790199Z"},"links":{"cited_paper":"/paper/1710.07300","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:ee2d6a2059826727734fca3585c890093b6616fd0c343679faabd9887514e202","observation_id":"d285ebb5-6d30-485e-8903-df7e028a2b79","resolution":{"observed_at":"2026-08-11T04:53:11.790199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:12.280582Z","title":"Li, Z., Wang, X., Stengel-Eskin, E., Kortylewski, A., Ma, W., Van Durme, B., and Yuille, A","venue":null,"work_id":"b801eadf-bd62-498d-8c93-095e071cc286","year":2024},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.803394Z"},"links":{"citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:a3666bf5a7019624a99180f2e8a8c90b45b9e7199505ed5454af4605704f67f3","observation_id":"46180e2c-6fcb-42e5-8063-9c7ba423f5a7","resolution":{"observed_at":"2026-08-11T04:53:12.285186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.05358","last_updated":"2022-08-10T14:08:34Z","snapshot_observed_at":"2026-08-19T16:19:29.152204Z","submitted_at":"2022-08-10T14:08:34Z","title":"CLEVR-Math: A Dataset for Compositional Language, Visual and Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.05358","snapshot_observed_at":"2026-08-11T04:53:11.807652Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.807652Z"},"links":{"cited_paper":"/paper/2208.05358","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:f04d06ef5cfaf181e738e3b928241d8fe081a012bdcdc24ec6f119f5fe93e5b1","observation_id":"5274f275-fe13-4bfc-ac1f-5685911b1364","resolution":{"observed_at":"2026-08-11T04:53:11.807652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-19T16:22:29.898436Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-11T04:53:11.811964Z","title":"Deepseek-vl: towards real-world vision-language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.811964Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:8d9dd1d138629bba6c481769e775f88b3551ec027e517222663461fbcffeb94d","observation_id":"e54dd486-895b-4c2f-97b7-bec701bf0d1a","resolution":{"observed_at":"2026-08-11T04:53:11.811964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06592","snapshot_observed_at":"2026-08-11T04:53:11.816269Z","title":"Improve mathemati- cal reasoning in language models by automated process supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.816269Z"},"links":{"cited_paper":"/paper/2406.06592","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:6d549cf1bf27172a8d472ae76c4e2cf5bc70d0af132863c654f2d3df678b70dd","observation_id":"8d457759-ff86-4225-81b8-b30da5703dce","resolution":{"observed_at":"2026-08-11T04:53:11.816269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10244","last_updated":"2022-03-19T05:00:30Z","snapshot_observed_at":"2026-08-11T03:45:43.920485Z","submitted_at":"2022-03-19T05:00:30Z","title":"ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10244","snapshot_observed_at":"2026-08-11T04:53:11.820533Z","title":"X., Tan, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.820533Z"},"links":{"cited_paper":"/paper/2203.10244","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:edd7c58eea462f77a1997cea4a4e0970cc9dc613017564c06ceb04c9c400985e","observation_id":"666598a6-b623-4e77-8fa6-9dd3c559b2df","resolution":{"observed_at":"2026-08-11T04:53:11.820533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:12.265807Z","title":"Solving geometry problems: Combining text and diagram interpretation","venue":null,"work_id":"15cbf789-4df3-47e2-ad1c-4d1890bcf771","year":2015},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.824617Z"},"links":{"citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:973230ec3033acf78a6350c8df505d3a1570b96b6ace1356aaebf3fa3d2ad8fe","observation_id":"0f9efeb2-6bdd-4959-b142-e174385ebb26","resolution":{"observed_at":"2026-08-11T04:53:12.271352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15767","last_updated":"2024-02-24T08:51:03Z","snapshot_observed_at":"2026-08-19T13:48:21.547681Z","submitted_at":"2024-02-24T08:51:03Z","title":"PhyPlan: Compositional and Adaptive Physical Task Reasoning with Physics-Informed Skill Networks for Robot Manipulators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15767","snapshot_observed_at":"2026-08-11T04:53:11.837943Z","title":"Phyplan: Composi- tional and adaptive physical task reasoning with physics- informed skill networks for robot manipulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.837943Z"},"links":{"cited_paper":"/paper/2402.15767","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:e05ede41cb3023caff96bb6789af1f72e4616a2ecab96d4bca36698e11897b82","observation_id":"a8a23b19-74db-4885-9b32-ec481d98c792","resolution":{"observed_at":"2026-08-11T04:53:11.837943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14804","last_updated":"2024-02-22T18:56:38Z","snapshot_observed_at":"2026-08-13T01:56:18.092262Z","submitted_at":"2024-02-22T18:56:38Z","title":"Measuring Multimodal Mathematical Reasoning with MATH-Vision Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14804","snapshot_observed_at":"2026-08-11T04:53:11.842388Z","title":"Mea- suring multimodal mathematical reasoning with math- vision dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.842388Z"},"links":{"cited_paper":"/paper/2402.14804","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:d163164e58c9106cd6e99dffee5391c1fc1397823763909a9f4faa6a7f3c5a22","observation_id":"20c68557-2c2d-4123-ba51-e3d50c2e887e","resolution":{"observed_at":"2026-08-11T04:53:11.842388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-11T04:53:11.846702Z","title":"Deepseek-vl2: Mixture- of-experts vision-language models for advanced multi- modal understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.846702Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:d4293072c93b2408e4d5a0461457ee763d5a6d9190f190f41e6a9c72ea8b7e11","observation_id":"edc18909-d823-484d-bd94-9334a14f1dd3","resolution":{"observed_at":"2026-08-11T04:53:11.846702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00451","last_updated":"2024-06-17T22:11:49Z","snapshot_observed_at":"2026-08-18T09:48:11.842015Z","submitted_at":"2024-05-01T11:10:24Z","title":"Monte Carlo Tree Search Boosts Reasoning via Iterative Preference Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00451","snapshot_observed_at":"2026-08-11T04:53:11.851150Z","title":"P., Kawaguchi, K., and Shieh, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.851150Z"},"links":{"cited_paper":"/paper/2405.00451","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:5dcd59210999ace50e9a5429cab53fb53b505f17f7f41e733b3fa46607ca6088","observation_id":"88b8f79a-7ea5-42ed-aba9-38b42bd20d11","resolution":{"observed_at":"2026-08-11T04:53:11.851150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-15T17:00:20.282987Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-08-11T04:53:11.855660Z","title":"Llava-o1: Let vision language models reason step-by- step","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.855660Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:34bf2453c78424aee77e4f67892e37f3f8b1bb44182157f290bc2fc649f4f31f","observation_id":"f336bb95-8206-4a23-948e-20d069caaece","resolution":{"observed_at":"2026-08-11T04:53:11.855660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00971","last_updated":"2023-11-02T03:39:14Z","snapshot_observed_at":"2026-08-17T08:16:09.547217Z","submitted_at":"2023-11-02T03:39:14Z","title":"An Integrated Framework Integrating Monte Carlo Tree Search and Supervised Learning for Train Timetabling Problem","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00971","snapshot_observed_at":"2026-08-11T04:53:11.859993Z","title":"An integrated framework integrating monte carlo tree search and supervised learning for train timetabling problem","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.859993Z"},"links":{"cited_paper":"/paper/2311.00971","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:bd3d5170c7cc02796259f7bcfc9d1f53732c1b30ab05bdf77665bf9b4b557fb2","observation_id":"1db25a7c-6ab2-41a6-97c8-a16b66e46da6","resolution":{"observed_at":"2026-08-11T04:53:11.859993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13800","last_updated":"2024-11-14T23:53:05Z","snapshot_observed_at":"2026-08-20T06:24:16.112659Z","submitted_at":"2024-05-22T16:25:03Z","title":"Dense Connector for MLLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13800","snapshot_observed_at":"2026-08-11T04:53:11.864340Z","title":"Dense connector for mllms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.864340Z"},"links":{"cited_paper":"/paper/2405.13800","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:8e0cea67aa5ddbf2bc2a1c7c827b389da920253b25b8675d4465a497265badd7","observation_id":"2420f65f-0a02-4be7-b9dc-0ea2495fe35a","resolution":{"observed_at":"2026-08-11T04:53:11.864340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02813","last_updated":"2025-05-22T08:22:02Z","snapshot_observed_at":"2026-08-20T22:20:11.069630Z","submitted_at":"2024-09-04T15:31:26Z","title":"MMMU-Pro: A More Robust Multi-discipline Multimodal Understanding Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02813","snapshot_observed_at":"2026-08-11T04:53:11.868800Z","title":"Mmmu-pro: A more robust multi-discipline multimodal understanding benchmark","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.868800Z"},"links":{"cited_paper":"/paper/2409.02813","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:b1756bf80f3a95328cc6480c20b3b696344c3d5af265699e3727076ef51cc7c6","observation_id":"140be8b1-b78b-4d2f-b878-247733deb9f2","resolution":{"observed_at":"2026-08-11T04:53:11.868800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03816","last_updated":"2024-11-18T05:36:16Z","snapshot_observed_at":"2026-08-19T22:24:29.848660Z","submitted_at":"2024-06-06T07:40:00Z","title":"ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03816","snapshot_observed_at":"2026-08-11T04:53:11.873185Z","title":"Rest-mcts*: Llm self-training via process reward guided tree search","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.873185Z"},"links":{"cited_paper":"/paper/2406.03816","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:eb198d0215a35cd9122e472980daf46b2d67187f5a63e46e0fe4081ee5f64705","observation_id":"6f2e1174-af77-4c1d-9cf2-9f6d4ef505a5","resolution":{"observed_at":"2026-08-11T04:53:11.873185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01347","last_updated":"2022-06-03T00:24:35Z","snapshot_observed_at":"2026-08-19T11:18:57.072870Z","submitted_at":"2022-06-03T00:24:35Z","title":"MultiHiertt: Numerical Reasoning over Multi Hierarchical Tabular and Textual Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.01347","snapshot_observed_at":"2026-08-11T04:53:11.877393Z","title":"Multihiertt: Numeri- cal reasoning over multi hierarchical tabular and textual data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.877393Z"},"links":{"cited_paper":"/paper/2206.01347","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:cd8ff14d146fc981af2dfd446a507f2578b75c85d016591320de63ac041645c6","observation_id":"9860984a-0cc5-4a06-84b4-1f1e3741a20e","resolution":{"observed_at":"2026-08-11T04:53:11.877393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:12.251384Z","title":null,"venue":null,"work_id":"0c29c61c-327b-446c-9416-40252403f762","year":2023},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.881661Z"},"links":{"citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:adb7cdd0c232e29e27a60eec5f8dd2a237af34011e99b34cc2c151e2532a2a4d","observation_id":"d2108ee9-3515-40f0-8f6b-26083aa9dba7","resolution":{"observed_at":"2026-08-11T04:53:12.256443Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.14517","last_updated":"2022-01-11T03:50:31Z","snapshot_observed_at":"2026-08-17T03:33:20.954386Z","submitted_at":"2021-05-30T12:34:17Z","title":"GeoQA: A Geometric Question Answering Benchmark Towards Multimodal Numerical Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.14517","snapshot_observed_at":"2026-08-11T04:53:11.750387Z","title":"P., and Lin, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.750387Z"},"links":{"cited_paper":"/paper/2105.14517","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:637ef06b0a604af4be421bf1ebdfc77a7da02ed728a6496a27cb469b317e81db","observation_id":"91801d1a-5dd6-4d6c-a5ee-027a0dcff59e","resolution":{"observed_at":"2026-08-11T04:53:11.750387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16860","last_updated":"2024-12-04T17:57:32Z","snapshot_observed_at":"2026-08-20T02:58:52.302783Z","submitted_at":"2024-06-24T17:59:42Z","title":"Cambrian-1: A Fully Open, Vision-Centric Exploration of Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16860","snapshot_observed_at":"2026-08-11T04:53:11.833403Z","title":"C., Yang, J., Yang, S., Iyer, A., Pan, X., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.833403Z"},"links":{"cited_paper":"/paper/2406.16860","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:82b69c195aa2c234871e8d999223a56a1a487f69b698cc27f8eea7fe21439cf8","observation_id":"84b70e61-b89e-403f-ac4e-bd605e7ec43c","resolution":{"observed_at":"2026-08-11T04:53:11.833403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-16T13:39:53.511689Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-11T04:53:11.828780Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.828780Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:cba2cd0053a941f1b3356c96cfee435cc7bcd9f71118fe3c58a26ef30f802ed2","observation_id":"dab83655-1716-4dc4-9ce1-41746ae4996e","resolution":{"observed_at":"2026-08-11T04:53:11.828780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11370","last_updated":"2025-08-20T15:45:11Z","snapshot_observed_at":"2026-08-19T23:16:39.427866Z","submitted_at":"2023-12-18T17:36:20Z","title":"G-LLaVA: Solving Geometric Problem with Multi-Modal Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11370","snapshot_observed_at":"2026-08-11T04:53:11.775687Z","title":"G-llava: Solving geo- metric problem with multi-modal large language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.775687Z"},"links":{"cited_paper":"/paper/2312.11370","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:b96ce515b9439e4e85b4e37e2f8dd25b6f4085859a269d373d37519d53bce86c","observation_id":"232e2a99-5574-490f-9ea4-cba47188c600","resolution":{"observed_at":"2026-08-11T04:53:11.775687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12241","last_updated":"2023-12-19T15:25:39Z","snapshot_observed_at":"2026-08-17T08:08:13.643438Z","submitted_at":"2023-12-19T15:25:39Z","title":"GeomVerse: A Systematic Evaluation of Large Models for Geometric Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12241","snapshot_observed_at":"2026-08-11T04:53:11.794660Z","title":"Geomverse: A systematic evaluation of large models for geometric reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.794660Z"},"links":{"cited_paper":"/paper/2312.12241","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:4fe84fdc6e4667572da219460808232cdf21e057213455fdda77566981ebc2a4","observation_id":"35174df6-e4c8-412c-a46c-9e505155b2f1","resolution":{"observed_at":"2026-08-11T04:53:11.794660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-11T04:53:11.781191Z","title":"and Zhang, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.781191Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:0d3bca6330796e039daeba7d4080aaee0325eab930a58d2c5b80e93df8592af7","observation_id":"37a6830a-9e8e-43ea-953f-aec62da1ffe3","resolution":{"observed_at":"2026-08-11T04:53:11.781191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02746","last_updated":"2022-12-06T04:37:51Z","snapshot_observed_at":"2026-08-16T16:10:44.189376Z","submitted_at":"2022-12-06T04:37:51Z","title":"UniGeo: Unifying Geometry Logical Reasoning via Reformulating Mathematical Expression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.02746","snapshot_observed_at":"2026-08-11T04:53:11.755682Z","title":"Unigeo: Unifying geometry logical reasoning via reformulating mathematical expression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.755682Z"},"links":{"cited_paper":"/paper/2212.02746","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:08cd1a5d41e57398781aeacb29803b88f4ad50125cff0bc757fecdd864ec1e67","observation_id":"8b741d1b-1012-4f4f-b367-94477b568d92","resolution":{"observed_at":"2026-08-11T04:53:11.755682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-08-17T14:16:52.244007Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-11T04:53:11.760494Z","title":"How far are we to gpt-4v? closing the gap to commercial multi- modal models with open-source suites","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.760494Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:be5553079656998256efbd64257c06e1bc50348f4d05521688bbc0ea19d32a0c","observation_id":"e1e86f5f-52a9-4d06-ba6d-8adc1f5c89ff","resolution":{"observed_at":"2026-08-11T04:53:11.760494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:11.799132Z","title":"A diagram is worth a dozen images","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.799132Z"},"links":{"citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:be82523b9423b82b829940d6d1a59180dbf25eb900d526d106f2d38f58824bca","observation_id":"eb4d3653-19db-4139-b6e9-6f77334002e5","resolution":{"observed_at":"2026-08-11T04:53:11.799132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T04:53:11.770720Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.770720Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:53cb17eb7fbd12d23c554950e7be1ebb761acfe1a9d927a87f2548e300cea536","observation_id":"d545414e-7000-4cbd-b9c8-548049589512","resolution":{"observed_at":"2026-08-11T04:53:11.770720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 68 inbound Pith citation observations for arXiv:2412.18319."}