{"as_of":"2026-08-08T20:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7da1c8e29ccb0f01d7c304898b63ed735a4cd2f9b7e80a962e98cfb74c487c97","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:13:58.155456Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.16151/citation-record","integrity":"/paper/2505.16151/integrity","json":"/paper/2505.16151/citation-record.json","paper":"/paper/2505.16151"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:13:51.828346Z","title":"DeepSeek-R1: Incentivizing reason- ing capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:51.828346Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:374924b47c592dfb4d9c595986f92668635633a95c27ca2583a8b763c092bb1c","observation_id":"b4a03c8d-c0d0-4c32-b66d-099fb747db79","resolution":{"observed_at":"2026-08-07T15:13:51.828346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T15:13:51.879241Z","title":"Kimi K1.5: Scaling reinforce- ment learning with llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:51.879241Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:dd32af8d7e42ada4d43960af633c42125172c6178244ced94e32bebe57ecc7ac","observation_id":"57845998-5e7e-4750-bcdc-a2068d408ced","resolution":{"observed_at":"2026-08-07T15:13:51.879241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12853","last_updated":"2025-02-18T13:40:22Z","snapshot_observed_at":"2026-08-07T18:08:48.524378Z","submitted_at":"2025-02-18T13:40:22Z","title":"S$^2$R: Teaching LLMs to Self-verify and Self-correct via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12853","snapshot_observed_at":"2026-08-07T15:13:51.984499Z","title":"S 2 R: Teaching llms to self-verify and self-correct via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:51.984499Z"},"links":{"cited_paper":"/paper/2502.12853","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:57e35365bef583beeb07c464e5eeca26af15e748b0ab516fb6b7a0aedf192b97","observation_id":"93e86eb5-d40a-4b50-8c8c-b65249a2b758","resolution":{"observed_at":"2026-08-07T15:13:51.984499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:04.267210Z","title":"Let’s verify step by step","venue":null,"work_id":"18957867-928b-40b4-918b-8dc7668715cf","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:52.146034Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:1e8960b2dbad80161ea61d4606373501e7bc37d860cc07fc28fd8c294d95c06f","observation_id":"0c42477e-565d-45e7-b736-146e083932f4","resolution":{"observed_at":"2026-08-07T15:14:04.355711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:04.055620Z","title":"OpenAI o1","venue":null,"work_id":"a3415c97-1495-4c50-b0e5-5a5dfda5acdd","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:52.295443Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:1599cbbe1ba964a3f851c3c54b8fc4cf54013f64755be9120805400d930a8965","observation_id":"beb3ea43-93c7-4bfa-92dd-cf5433b58684","resolution":{"observed_at":"2026-08-07T15:14:04.149806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-07T09:36:29.319006Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-08-07T15:13:52.385935Z","title":"LLaV A-o1: Let vision language models reason step-by-step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:52.385935Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:1a1da381f7b1f8fc933686738ebeb9a12106aef652daa0b126560c07b54fc2dd","observation_id":"41caa1b0-7bc0-4854-b185-0b4f219ffe8b","resolution":{"observed_at":"2026-08-07T15:13:52.385935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:03.864859Z","title":"Insight-V: Exploring long-chain visual reasoning with multimodal large language models","venue":null,"work_id":"d6f3b708-3a33-47a9-a969-019abafc0e25","year":2025},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:52.502448Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:d382d1e56e035767bee0d4b2e16453f0a051862685788710e921c610ed18b170","observation_id":"14cf2302-bd83-4130-928c-a89068c677ce","resolution":{"observed_at":"2026-08-07T15:14:03.936163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-08T00:04:35.299538Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T15:13:52.634235Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:52.634235Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:b0c9e73006ca46e9b51e0701df390cdc65dfb6e4652fb58e026e8014893b04f3","observation_id":"9d634656-5c72-4ccb-9890-89369531f8f8","resolution":{"observed_at":"2026-08-07T15:13:52.634235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01785","last_updated":"2025-03-03T18:16:32Z","snapshot_observed_at":"2026-08-05T03:13:54.147007Z","submitted_at":"2025-03-03T18:16:32Z","title":"Visual-RFT: Visual Reinforcement Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01785","snapshot_observed_at":"2026-08-07T15:13:52.747958Z","title":"Visual- RFT: Visual reinforcement fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:52.747958Z"},"links":{"cited_paper":"/paper/2503.01785","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:7f28780e15935bd1a68893038981af514d499d6fbf2cdf7f6f67dad721ae3873","observation_id":"c58e677e-b258-4034-85c2-3c79f7f93288","resolution":{"observed_at":"2026-08-07T15:13:52.747958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-07T15:13:52.912688Z","title":"Vision- R1: Incentivizing reasoning capability in multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:52.912688Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:a4fd25a9d1bdaebea78627790461b0432d9e1bc3d05e5e5e171fc75ba8ea0ab7","observation_id":"c0044c76-f0d6-480e-bf76-6e1045f06c76","resolution":{"observed_at":"2026-08-07T15:13:52.912688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-07T15:13:53.084279Z","title":"LMM-R1: Empowering 3b lmms with strong reasoning abilities through two-stage rule-based rl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:53.084279Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:409a96abaaf69e433adb36cbe454736752c1893d8e409232184e75f2b7e4901a","observation_id":"c16d2579-a035-41ab-91e7-114625bcacae","resolution":{"observed_at":"2026-08-07T15:13:53.084279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12937","last_updated":"2025-08-04T04:22:09Z","snapshot_observed_at":"2026-08-06T21:34:54.534751Z","submitted_at":"2025-03-17T08:51:44Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12937","snapshot_observed_at":"2026-08-07T15:13:53.259417Z","title":"R1-VL: Learning to reason with multimodal large language models via step-wise group relative policy optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:53.259417Z"},"links":{"cited_paper":"/paper/2503.12937","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:f2bed751b9cc9c7233558f68995c04487169ac918132f1cf22539cedb58e065b","observation_id":"0c3d472a-cddc-490d-aac9-d9e2ba56f329","resolution":{"observed_at":"2026-08-07T15:13:53.259417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:03.689432Z","title":"Morcos, Hongseok Namkoong, Ali Farhadi, Yair Carmon, Simon Kornblith, and Ludwig Schmidt","venue":null,"work_id":"b3d7811a-7f1f-4445-87dc-a2b9a61a629b","year":2022},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:53.411747Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:5bbd02c4a83568b0fe1814f39fb2e922297148ce4e3ff0af9eb584b8baec229f","observation_id":"b9901528-38be-4f40-ad0f-a6bc60af2194","resolution":{"observed_at":"2026-08-07T15:14:03.795695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:03.554627Z","title":"Editing models with task arithmetic","venue":null,"work_id":"5a9d9d4f-fc89-4d19-a11d-15d90b89c8d9","year":2023},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:53.532874Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:326840ee63ca0053f2d01b795a7f040034c016758e31045cb0dfc7c4ec22562d","observation_id":"d55647b8-133f-4200-a45d-331eab01d5c3","resolution":{"observed_at":"2026-08-07T15:14:03.631396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:03.352539Z","title":"Composing parameter-efficient modules with arithmetic operation","venue":null,"work_id":"d00693fe-4579-4e80-af70-5bb4a5db35fb","year":2023},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:53.655470Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:bffeb29479394fcd77dc189a0eb32b36db6023b4828c3ecf5cbabdbcd4cde081","observation_id":"fd227eb9-e86f-44c5-9d0d-9148a56e3c05","resolution":{"observed_at":"2026-08-07T15:14:03.426559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:03.160367Z","title":"Gradual progression from sensory to task-related processing in cerebral cortex","venue":null,"work_id":"6fef156f-0de2-4c95-ad1e-85d0e8f4d777","year":2018},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:53.801760Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:56a1224bc6703e280251dfbc8342e93601586b6b994150db52cacf9af3f732f5","observation_id":"93053a11-4333-411e-9419-5bb4c56a9471","resolution":{"observed_at":"2026-08-07T15:14:03.243842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:02.989108Z","title":"Hierarchical processing of visual and language information in the brain","venue":null,"work_id":"dea45f9f-70e1-415c-8157-aef08cbfa0d1","year":2022},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:53.915991Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:5225f34fe4f55168393ddb09e2bd1bd69cd8ad00b69de8671c744c80dfb71f39","observation_id":"db001b72-5745-4abe-abc6-1b1c1e4d1378","resolution":{"observed_at":"2026-08-07T15:14:03.048780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:54.045942Z","title":"Visionllm: Large language model is also an open-ended decoder for vision-centric tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:54.045942Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:eb7ea057cd4e0929b8b1a78f085703859a5a53041b46d589cce9a5469ebb799a","observation_id":"37983c83-55b1-4773-8a90-c17d4a67db5d","resolution":{"observed_at":"2026-08-07T15:13:54.045942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T15:13:54.232145Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:54.232145Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:f1ac9f7b258689f7e506534444fa06888ca2a5851a2b05838ec7f33fd8535e3a","observation_id":"ae20434e-d4d3-41ad-933e-ed70bf3a7f99","resolution":{"observed_at":"2026-08-07T15:13:54.232145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:02.771323Z","title":"Visual instruction tuning","venue":null,"work_id":"2cd89b47-665f-41fa-83f6-fbde4bfa7e2e","year":2023},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:54.390407Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:1cd2d27c8f3382f30b18cc8b140e2e3ee4dabb3b1d77eac914dc2fd898294449","observation_id":"9bd3e0e5-35f8-4239-8ce2-90440b2bab58","resolution":{"observed_at":"2026-08-07T15:14:02.852006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:02.583145Z","title":"Emu: Generative pretraining in multimodality","venue":null,"work_id":"c5c90742-a665-4b42-97e5-1e9d2373a557","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:54.529176Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:27c8063a196190d5533dc5bfae20e49e8b570e1dbc54cd6e49fc4a85d8da648b","observation_id":"6cde11fc-f8ee-44cb-91ca-8af5c0207f04","resolution":{"observed_at":"2026-08-07T15:14:02.676886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:02.402643Z","title":"Chi, Quoc V","venue":null,"work_id":"9502f4cd-c68e-43c2-b066-8fb0f6e38c41","year":2022},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:54.654112Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:3aca4fc4b953c250a64df483ab489e00866a92c8fe07aab04b4a33341ea1530c","observation_id":"7ee25ad8-f013-4c6f-b450-7203ce445ce8","resolution":{"observed_at":"2026-08-07T15:14:02.505631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16198","last_updated":"2024-10-21T17:00:06Z","snapshot_observed_at":"2026-08-08T03:30:51.616377Z","submitted_at":"2024-10-21T17:00:06Z","title":"Improve Vision Language Model Chain-of-thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16198","snapshot_observed_at":"2026-08-07T15:13:54.759630Z","title":"Improve vision lan- guage model chain-of-thought reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:54.759630Z"},"links":{"cited_paper":"/paper/2410.16198","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:33558a1bf79b635366f34631c2ec2752eaa2d5f8ff5cc2fe1c2ac996706f12a4","observation_id":"7068f311-2234-4343-9571-58b2bc26b0ea","resolution":{"observed_at":"2026-08-07T15:13:54.759630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:02.242168Z","title":"Compositional chain-of-thought prompting for large multimodal models","venue":null,"work_id":"908e3a55-7b23-468a-ad3a-612830250f36","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:54.882809Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:a154d7fae725065d1d0266c9f32fe8dbe2db0a10c0c6742c2440673d2a3aad3c","observation_id":"cd65305a-d2d3-4566-9141-65de8ebf159f","resolution":{"observed_at":"2026-08-07T15:14:02.272805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09797","last_updated":"2024-04-15T13:54:35Z","snapshot_observed_at":"2026-08-06T15:21:57.862557Z","submitted_at":"2024-04-15T13:54:35Z","title":"TextCoT: Zoom In for Enhanced Multimodal Text-Rich Image Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09797","snapshot_observed_at":"2026-08-07T15:13:55.011386Z","title":"TextCoT: Zoom in for en- hanced multimodal text-rich image understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:55.011386Z"},"links":{"cited_paper":"/paper/2404.09797","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:bf69fd844cd96e08e768efcf6d0cee54e73e767619fc719d2b0699f499bc4df9","observation_id":"14d2e6a5-43c5-4b83-9c53-e5550f74b49f","resolution":{"observed_at":"2026-08-07T15:13:55.011386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-07-06T20:49:56.018809Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-07T15:13:55.145082Z","title":"MM-Eureka: Exploring the frontiers of multimodal reasoning with rule-based re- inforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:55.145082Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:73d7c01d70b59b76b6b069c40f451543498442f984af1a7381c755918f70dec1","observation_id":"6727c625-bba4-4568-a169-45ca1b8fe1a3","resolution":{"observed_at":"2026-08-07T15:13:55.145082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:02.097771Z","title":"Merging models with fisher-weighted averaging","venue":null,"work_id":"6290c4f4-d471-4c5f-981d-b00a6a0823ed","year":2022},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:55.288092Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:dc7617d8051105a30a56740515298bddabfca05c67de07ccd6b3b7a4e6f79107","observation_id":"897af4c1-7e20-4dd4-878f-c34a3423183d","resolution":{"observed_at":"2026-08-07T15:14:02.178644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:01.945588Z","title":"Raffel, and Mohit Bansal","venue":null,"work_id":"97a19d44-5694-461e-aec3-284d7f7684d1","year":2023},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:55.377913Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:aba20f797b2599a2f0d16057595ed1fc3daed2b77e7edd1a83dd8e426f89423e","observation_id":"b96f9645-0ec3-4ef9-ac84-ff3177a291a9","resolution":{"observed_at":"2026-08-07T15:14:02.038488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:01.776049Z","title":"Metagpt: Merging large language models using model exclusive task arithmetic","venue":null,"work_id":"939ad4bd-a13f-44bd-aa85-fd61cd3c7fd5","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:55.488112Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:eaf47e4e11cbefc33dd5f54ee7ac460cb38cc9d68045bb25add51cba673675c4","observation_id":"198173b2-c49d-4ca9-8ece-5f69c3f9a79a","resolution":{"observed_at":"2026-08-07T15:14:01.860402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:01.693465Z","title":"Dataless knowledge fusion by merging weights of language models","venue":null,"work_id":"77120d08-2531-46f1-8036-05dde624d70e","year":2023},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:55.556366Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:3984e0fa1b3b5e735c129f382a8fedd921d57743c4016d03dd62c8d11306ca4a","observation_id":"b0e58955-0b2b-44e3-99ae-a2e60fbe3d22","resolution":{"observed_at":"2026-08-07T15:14:01.719617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:01.491649Z","title":"Language models are super mario: Absorbing abilities from homologous models as a free lunch","venue":null,"work_id":"00e7c832-352f-4113-945e-8ac8d566f6a0","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:55.649661Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:484fa207eefdb2544b136d7c4f876fd28319cc774f3ef9f13498703069c385bd","observation_id":"c95559bb-14b1-4004-9cb1-c43d4b8ecdc7","resolution":{"observed_at":"2026-08-07T15:14:01.603696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05464","last_updated":"2025-07-15T06:09:44Z","snapshot_observed_at":"2026-08-07T15:48:41.620409Z","submitted_at":"2025-05-08T17:56:23Z","title":"Bring Reason to Vision: Understanding Perception and Reasoning through Model Merging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05464","snapshot_observed_at":"2026-08-07T15:13:55.819405Z","title":"Bring reason to vision: Understanding perception and reasoning through model merging","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:55.819405Z"},"links":{"cited_paper":"/paper/2505.05464","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:4abdb4d163c48c46815b2ccd5f739bd4b2c9356cee24489408e9cf18c60bd2d3","observation_id":"c9568ce4-e1e1-418e-97cd-37470082b171","resolution":{"observed_at":"2026-08-07T15:13:55.819405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:01.351473Z","title":"Neu- ral Tangent Kernel: Convergence and generalization in10 neural networks","venue":null,"work_id":"1862d25b-1793-4ddd-87b3-4d4118236891","year":2018},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:55.972987Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:cc8484c98ef8052cf20166648d3bd53ce6b26800ae95b339286e6c38fcac66f4","observation_id":"babf7510-ac6f-4b55-b94a-f9be4d6483b0","resolution":{"observed_at":"2026-08-07T15:14:01.423826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T15:13:56.060872Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:56.060872Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:3f1891731aad6a4c748a0f76618cfec9b30cc174f27ef46e3f2a4c20c4e8c640","observation_id":"5fdac022-bc8f-44fd-b5b0-c1eba68b3f94","resolution":{"observed_at":"2026-08-07T15:13:56.060872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:01.172763Z","title":"AGIEval: A human-centric benchmark for evaluating foundation models","venue":null,"work_id":"7c4d73d6-9c5c-42f1-81e8-3f6f84a3ffa0","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:56.214550Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:7cc7f8b3dde56e6acc5b9687fdbe30b55506005c02815ee747992721804a87a1","observation_id":"383efb5e-2548-4a87-a036-59f905451354","resolution":{"observed_at":"2026-08-07T15:14:01.259648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:01.040082Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"a7d302b4-800d-49c5-be2c-8d7f454a6ed0","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:56.305641Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:8b0cd0801e9d1c21dfc02a90388f4f39f41d85b52ca6b4fb6a21db80a2d02e82","observation_id":"a0006f44-3ad8-4b4c-bafb-60e3314e2184","resolution":{"observed_at":"2026-08-07T15:14:01.109036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:00.871427Z","title":"Llava- next","venue":null,"work_id":"eceade65-79f9-4d2d-b25d-c0447f831d81","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:56.410192Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:8e1bdb4341c1871f59250facc3684275bf35746735eb2a3464cdbe34509bbca5","observation_id":"80fa561b-4be0-40a4-bc90-2158c8d5e01e","resolution":{"observed_at":"2026-08-07T15:14:00.942818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:00.745757Z","title":"VILA: on pre-training for visual language models","venue":null,"work_id":"fb546cc4-99f4-4b76-9c5f-b149febfc923","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:56.536836Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:6886984f4f196bbac1fff6b02dcf39687091af7981929694c6873278fbeb4a10","observation_id":"0a029e9f-43ef-4f43-a265-d67a00e0aef5","resolution":{"observed_at":"2026-08-07T15:14:00.804085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:00.617999Z","title":"Building and better understanding vision- language models: insights and future directions","venue":null,"work_id":"434770e1-8636-411c-91d4-1b1ad7e8105e","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:56.609209Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:3d137c3c99d2954092660c265fcec49b3ce08a96c8db4b09a574a5148a040dfb","observation_id":"71c96e96-d19e-42a1-9d43-e83aa32072a7","resolution":{"observed_at":"2026-08-07T15:14:00.681087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:00.435915Z","title":"Sharegpt4v: Improving large multi-modal models with better captions","venue":null,"work_id":"06e9ccdc-9f4a-4194-bdd7-94f2bb99baec","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:56.679480Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:fb4435e539537f9b12a2f35b2f450aac2d8194df7b926d12b33605eba5136d58","observation_id":"79992ad2-8c98-474b-ba7a-df3a9f70a619","resolution":{"observed_at":"2026-08-07T15:14:00.508551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04468","last_updated":"2026-04-25T07:16:42Z","snapshot_observed_at":"2026-08-03T08:48:57.969106Z","submitted_at":"2024-12-05T18:59:55Z","title":"NVILA: Efficient Frontier Visual Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04468","snapshot_observed_at":"2026-08-07T15:13:56.772463Z","title":"Nvila: E fficient frontier visual language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:56.772463Z"},"links":{"cited_paper":"/paper/2412.04468","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:63a85f41c2563f4be9993067095132d34d8e1b5944e7a887d6002b9de4dfef68","observation_id":"a8dab4d0-57e2-4045-bbef-6ea7cf7dc34d","resolution":{"observed_at":"2026-08-07T15:13:56.772463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:00.253108Z","title":"LLaV A-OneVision: Easy visual task transfer","venue":null,"work_id":"a93d025c-9651-4a76-b23b-8fdd7e19b35a","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:56.841558Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:aa1c0286f369f5295967c4ef15f7a5f57ec3a42ab331f0704c2ba37eabc468d3","observation_id":"69526aa6-a77e-4f0d-8ee7-a0e8566f7696","resolution":{"observed_at":"2026-08-07T15:14:00.340628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T15:13:56.924965Z","title":"Qwen2-VL: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:56.924965Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:88d2090e960c0062576bcc4dac6b87c44d9d5e9bfc853519313c2817ab06628c","observation_id":"52f83b67-50cc-4255-8a95-013e8a8d3ad3","resolution":{"observed_at":"2026-08-07T15:13:56.924965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:14:00.072063Z","title":null,"venue":null,"work_id":"a2a05a67-a70f-44ee-b050-6a7354a96e66","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:57.024187Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:5305a8ef590c09175bd8ca293b190742a95f56553303f01d368e3c3280e6c416","observation_id":"2cdb1580-914e-48d7-af6b-f22e16ec8d97","resolution":{"observed_at":"2026-08-07T15:14:00.145206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T15:13:57.151656Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:57.151656Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:09a98deb94b6d6431fab5f736658b5d68b5bd8d794e8e5f1c7016a968d734b70","observation_id":"294efcf3-6fe5-4ed8-bcf1-da716dec89ff","resolution":{"observed_at":"2026-08-07T15:13:57.151656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:59.888859Z","title":"MMMU: A massive multi-discipline multi- modal understanding and reasoning benchmark for expert AGI","venue":null,"work_id":"dd900abb-6bdb-4e3d-a947-dab46242619f","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:57.319687Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:683c522f6a30c8334a9da9ba5f177bf4e74fee1584846034f70ba07bf0dd198a","observation_id":"ce5f00e2-6d81-4ddf-a05d-8b68d7b1f3bb","resolution":{"observed_at":"2026-08-07T15:13:59.979941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02813","last_updated":"2025-05-22T08:22:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-04T15:31:26Z","title":"MMMU-Pro: A More Robust Multi-discipline Multimodal Understanding Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02813","snapshot_observed_at":"2026-08-07T15:13:57.403852Z","title":"MMMU-Pro: A more ro- bust multi-discipline multimodal understanding bench- mark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:57.403852Z"},"links":{"cited_paper":"/paper/2409.02813","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:ecf4568c24f71b66f12886cfdf8805b589c5b0ae3d42a541b48db86e7d0ee941","observation_id":"7a260aa3-ee5a-4850-a16c-4fa8b2149eb9","resolution":{"observed_at":"2026-08-07T15:13:57.403852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:59.752009Z","title":"MathVista: Evaluating mathematical reasoning of foundation models in visual contexts","venue":null,"work_id":"29e2dd40-1bfb-44b0-9df2-853efa38dea6","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:57.534671Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:15f6af5f7707507d4991d9988e8f34a483b842d5f8228fc988bddc40ff8253e4","observation_id":"598d3a4f-c541-4a1e-85f4-24484d68a512","resolution":{"observed_at":"2026-08-07T15:13:59.801231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:59.641968Z","title":"Measuring multimodal mathematical reasoning with math- vision dataset","venue":null,"work_id":"0135067e-cd06-420c-8c3a-adfb0f4eb4e3","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:57.670724Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:57f7ff1a2a8e65271cd9118a6d1684cb3fa90f0d8c150be313391ebbb45f6055","observation_id":"1f77ec34-5c6e-427d-8fbf-dba8e89d4de6","resolution":{"observed_at":"2026-08-07T15:13:59.680133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01284","last_updated":"2024-07-01T13:39:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-01T13:39:08Z","title":"We-Math: Does Your Large Multimodal Model Achieve Human-like Mathematical Reasoning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01284","snapshot_observed_at":"2026-08-07T15:13:57.748180Z","title":"We-math: Does your large multimodal model achieve human-like mathematical reasoning? arXiv preprint arXiv:2407.01284, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:57.748180Z"},"links":{"cited_paper":"/paper/2407.01284","citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:9c2fffabc770969cefb52747caa67e3cf2a6eae7fa97f62b667ddc00254198fb","observation_id":"237520f4-695a-42dd-bf94-e5bc8b55970d","resolution":{"observed_at":"2026-08-07T15:13:57.748180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:59.531991Z","title":null,"venue":null,"work_id":"2389567a-7e3b-491e-9e85-991f7c309386","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:57.824122Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:f342228d19cfe532f035d841d0c1b108380a85fd5a468fab2c1b8dca0604f065","observation_id":"c4dd5115-8240-4cc4-8aee-bf37bff505c7","resolution":{"observed_at":"2026-08-07T15:13:59.569232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:59.385428Z","title":"Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Dollár, and C","venue":null,"work_id":"fec25243-f34d-44b5-8b8b-802ae4e10935","year":2014},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:57.957815Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:5fa785313703942bf9cb7bcb6f48733fa87ed925fda1aabb35d630e99651b42e","observation_id":"f9cbc9b4-afda-41ea-be0c-aa0ac8f62cd1","resolution":{"observed_at":"2026-08-07T15:13:59.427612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:59.236924Z","title":"Non-Reasoning MLLM","venue":null,"work_id":"f948e8ca-2a63-43d5-a676-11574c70412a","year":2024},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:58.054094Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:f76ae4d4fb723378688cf802936f7e1d7c6771d5f870e14863c5c857da4d2f6e","observation_id":"a7941d7c-dc4a-4bf6-96fa-b588987efdcd","resolution":{"observed_at":"2026-08-07T15:13:59.285079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:59.076338Z","title":null,"venue":null,"work_id":"4bb7ae30-50a9-4054-910a-60917245e6e7","year":null},"citing_paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:58.155456Z"},"links":{"citing_paper":"/paper/2505.16151"},"observation_digest":"sha256:f8399260ee7ad8701ad7dde4e4b0f9f0fa917ee879730b1cb31f327ab9ee5fbd","observation_id":"35c9be25-702f-4eb6-99ec-11fa196a66ac","resolution":{"observed_at":"2026-08-07T15:13:59.157793Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16151","last_updated":"2025-05-22T02:51:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:05:12.577070Z","submitted_at":"2025-05-22T02:51:12Z","title":"Training-Free Reasoning and Reflection in MLLMs"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":30},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2505.16151."}