{"as_of":"2026-08-08T22:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c2587bcc408cfd59cae8fd725b9d170db11c91049ffe9aeac7af8257943a4919","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":41,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T15:26:07.809728Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T20:48:56.041994Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-08T15:26:07.809728Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning ro- bustness of vision language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06453","last_updated":"2025-02-12T23:16:27Z","snapshot_observed_at":"2026-08-08T15:20:43.084873Z","submitted_at":"2025-02-10T13:31:46Z","title":"MATH-Perturb: Benchmarking LLMs' Math Reasoning Abilities against Hard Perturbations","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T15:26:07.809728Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2502.06453"},"observation_digest":"sha256:1ff357882d5ff29025e14e53837abb18d55747b80ef1506cc0ee5cec35cc7b41","observation_id":"4794ee11-da2e-46c1-84dc-2d3eaaa2a716","resolution":{"observed_at":"2026-08-08T15:26:07.809728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-07T12:50:27.666060Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T00:19:20.462455Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2503.10615"},"observation_digest":"sha256:d4a20d87e4b7d9a169e1ae5748c6644aaa03fd031eba901b4d8b3e2c650b918d","observation_id":"c2dd2c26-2ff9-4d2e-9eea-9e2b62982ada","resolution":{"observed_at":"2026-05-16T00:19:20.565097Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2503.12937","last_updated":"2025-08-04T04:22:09Z","snapshot_observed_at":"2026-08-06T21:34:54.534751Z","submitted_at":"2025-03-17T08:51:44Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-16T15:04:22.690503Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2503.12937"},"observation_digest":"sha256:160c5ab6e723ab0cfb5edd3b9f18c74bcbcb1e7fe47b1cceeb69b1afdaa45e4f","observation_id":"54d46fca-135d-447d-8e2c-1e722cc02ab6","resolution":{"observed_at":"2026-05-16T15:04:22.722652Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"reference_index":156,"source":"pdf_text","source_observed_at":"2026-05-10T13:41:07.991012Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2504.10479"},"observation_digest":"sha256:bddb4c36d5f6075e4b8a7525c48a2500bf2496414dcb7691cf3a014abea0e2bb","observation_id":"cae3aea9-046d-48a6-b246-c7d7fac5a7dd","resolution":{"observed_at":"2026-05-10T13:41:08.033152Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2505.14362","last_updated":"2026-03-01T04:59:56Z","snapshot_observed_at":"2026-08-02T12:23:34.946873Z","submitted_at":"2025-05-20T13:48:11Z","title":"DeepEyes: Incentivizing \"Thinking with Images\" via Reinforcement Learning","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-11T14:42:56.565621Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2505.14362"},"observation_digest":"sha256:70b0680a070f52faa82c3b87c7bee492fde7ba6215a35de9feab67bef02fea96","observation_id":"c1496f25-d005-4f09-80d0-1a64808b027e","resolution":{"observed_at":"2026-05-11T14:42:56.825358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-07T15:21:08.559862Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15435","last_updated":"2025-05-21T12:18:02Z","snapshot_observed_at":"2026-08-07T15:15:34.671409Z","submitted_at":"2025-05-21T12:18:02Z","title":"TimeCausality: Evaluating the Causal Ability in Time Dimension for Vision Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T15:21:08.559862Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2505.15435"},"observation_digest":"sha256:1b30be911260d5992ab63bd5a4d5aea33922aaa505684704ed74dae81fe16bd4","observation_id":"5ae7bb7b-10ed-462e-908c-fd816a7b30b4","resolution":{"observed_at":"2026-08-07T15:21:08.559862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-07T11:04:14.304184Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03569","last_updated":"2025-06-04T04:32:54Z","snapshot_observed_at":"2026-08-07T10:57:30.804332Z","submitted_at":"2025-06-04T04:32:54Z","title":"MiMo-VL Technical Report","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:14.304184Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2506.03569"},"observation_digest":"sha256:84f4a0b27107dbb0ac615935dd34ae30fe711512f08059b5dc743feeac884083","observation_id":"1b61006d-4166-4d49-ad64-4c018a689bad","resolution":{"observed_at":"2026-08-07T11:04:14.304184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-07T05:27:05.225253Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models.arXiv preprint arXiv:2411.00836, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07905","last_updated":"2025-06-09T16:20:54Z","snapshot_observed_at":"2026-08-07T21:24:53.935343Z","submitted_at":"2025-06-09T16:20:54Z","title":"WeThink: Toward General-purpose Vision-Language Reasoning via Reinforcement Learning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T05:27:05.225253Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2506.07905"},"observation_digest":"sha256:68d9ff370b786d27cae7a55d3f65ca6c82c29b801e24f8a51e6c9663d8f70bff","observation_id":"a5bc9403-a0d6-4efd-b92f-bc0e7a252ec1","resolution":{"observed_at":"2026-08-07T05:27:05.225253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-06T21:41:41.103071Z","title":"Dynamath: A dynamic visual bench- mark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23563","last_updated":"2025-06-30T07:14:38Z","snapshot_observed_at":"2026-08-08T00:06:37.560828Z","submitted_at":"2025-06-30T07:14:38Z","title":"MMReason: An Open-Ended Multi-Modal Multi-Step Reasoning Benchmark for MLLMs Toward AGI","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T21:41:41.103071Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2506.23563"},"observation_digest":"sha256:e3639ea3e45ddf2cf9bd462917fea010c15e4f3ec9f93060aff371172d635f26","observation_id":"68b418f4-f233-4f31-b187-9a27584609bf","resolution":{"observed_at":"2026-08-06T21:41:41.103071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-11T04:48:26.355351Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2507.01006"},"observation_digest":"sha256:46677c43e787d23b704f024e3dd1077b512dc2bf984e6ba1a72f0dfddb15b031","observation_id":"b7f21d7b-1304-4d8e-aa23-099a7a46970d","resolution":{"observed_at":"2026-05-11T04:48:27.265524Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-06T20:45:10.546613Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01949","last_updated":"2025-07-02T17:57:28Z","snapshot_observed_at":"2026-08-06T20:37:19.866170Z","submitted_at":"2025-07-02T17:57:28Z","title":"Kwai Keye-VL Technical Report","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:10.546613Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2507.01949"},"observation_digest":"sha256:89f5a115f140128ffe546155aa80b27e275690ec09558d17498971cca1f6f788","observation_id":"9da45d34-702a-41cc-9fa9-a0241d60580d","resolution":{"observed_at":"2026-08-06T20:45:10.546613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-06T20:15:52.701699Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03483","last_updated":"2025-07-08T05:05:04Z","snapshot_observed_at":"2026-08-08T08:25:33.597241Z","submitted_at":"2025-07-04T11:20:09Z","title":"BMMR: A Large-Scale Bilingual Multimodal Multi-Discipline Reasoning Dataset","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:15:52.701699Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2507.03483"},"observation_digest":"sha256:a20e28a0458bae2249b6cd69e1fd0e755d18fb9a8a184ff93f6d773de1510e08","observation_id":"e509b6e9-ec44-41bd-865e-d1e0d170bfc1","resolution":{"observed_at":"2026-08-06T20:15:52.701699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-06T15:26:02.359760Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16863","last_updated":"2026-06-24T02:13:52Z","snapshot_observed_at":"2026-08-06T15:16:29.727632Z","submitted_at":"2025-07-21T21:50:16Z","title":"Position: Reasoning After Perception Means Reasoning Without Vision","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T15:26:02.359760Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2507.16863"},"observation_digest":"sha256:c8d4bada12c5761a4217397ddad7a044f5273ef1118d7134576460e71dc8637e","observation_id":"78c0a6e1-1605-47cb-86ed-90f98db30e62","resolution":{"observed_at":"2026-08-06T15:26:02.359760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-06T00:59:54.936904Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04088","last_updated":"2025-08-07T03:52:48Z","snapshot_observed_at":"2026-08-08T12:10:28.774282Z","submitted_at":"2025-08-06T05:10:29Z","title":"GM-PRM: A Generative Multimodal Process Reward Model for Multimodal Mathematical Reasoning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T00:59:54.936904Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2508.04088"},"observation_digest":"sha256:9fcb12bdaa20418b9f85cecf37cfdb955456a4235279b69998839dc583c8d823","observation_id":"25648867-0a60-4698-8cd4-62272875f645","resolution":{"observed_at":"2026-08-06T00:59:54.936904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-05T23:03:10.178730Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06009","last_updated":"2025-08-08T04:39:16Z","snapshot_observed_at":"2026-08-06T16:03:13.511884Z","submitted_at":"2025-08-08T04:39:16Z","title":"MathReal: We Keep It Real! A Real Scene Benchmark for Evaluating Math Reasoning in Multimodal Large Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-05T23:03:10.178730Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2508.06009"},"observation_digest":"sha256:0cce66d5a746c36c289dc7b197320bec4223f8cf9cce7dc8f87cc0fc38bedef7","observation_id":"803706d1-06d3-4b48-8f87-64fdea209998","resolution":{"observed_at":"2026-08-05T23:03:10.178730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"reference_index":190,"source":"pdf_text","source_observed_at":"2026-05-10T11:58:58.660564Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2508.18265"},"observation_digest":"sha256:f56df941eba9eccb50f4327b65aa3e672b9b3cc139cda345cbe1b52d5da76662","observation_id":"6b2461dd-f50c-4b0b-b157-80895269b884","resolution":{"observed_at":"2026-05-10T11:58:59.011849Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-05T14:42:21.125850Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21113","last_updated":"2025-09-02T13:37:38Z","snapshot_observed_at":"2026-08-05T14:42:19.666014Z","submitted_at":"2025-08-28T17:48:19Z","title":"R-4B: Incentivizing General-Purpose Auto-Thinking Capability in MLLMs via Bi-Mode Annealing and Reinforce Learning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:21.125850Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2508.21113"},"observation_digest":"sha256:375fa30f9e39d31925e9d7cc91b090027b61b66c208f35c90090b69f4445a17a","observation_id":"9e06aefb-62f4-4a2c-a405-f24a37aebcb5","resolution":{"observed_at":"2026-08-05T14:42:21.125850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-05T12:28:31.683925Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.01563","last_updated":"2025-09-07T13:40:44Z","snapshot_observed_at":"2026-08-08T11:15:53.631141Z","submitted_at":"2025-09-01T15:46:58Z","title":"Kwai Keye-VL 1.5 Technical Report","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T12:28:31.683925Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2509.01563"},"observation_digest":"sha256:8ced412e2c6308ac4f57e81df5de3e8ca3142edb54dd338ff2a262cd1d88b97d","observation_id":"2a76cfdb-d8cb-4be2-b25b-a98ce65010b4","resolution":{"observed_at":"2026-08-05T12:28:31.683925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-04T19:53:10.732656Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09013","last_updated":"2025-09-10T21:16:11Z","snapshot_observed_at":"2026-08-06T18:22:51.519108Z","submitted_at":"2025-09-10T21:16:11Z","title":"Can Vision-Language Models Solve Visual Math Equations?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T19:53:10.732656Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2509.09013"},"observation_digest":"sha256:0c687000327239a28c4b02c90da0ec8f2cee1a735b7bb8a82f5d49fa7cc91ba9","observation_id":"1ff0b8d2-eeb1-4d9b-8ca6-3d5e54c15a04","resolution":{"observed_at":"2026-08-04T19:53:10.732656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2511.19972","last_updated":"2026-05-07T02:58:13Z","snapshot_observed_at":"2026-08-06T20:13:12.622191Z","submitted_at":"2025-11-25T06:31:57Z","title":"Boosting Reasoning in Large Multimodal Models via Activation Replay","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-17T05:05:48.682057Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2511.19972"},"observation_digest":"sha256:10e78c7f7e049f7b17d68b0fadf824d5b3dcd60f89c97ad6a8be6bf0386f7210","observation_id":"bb89482a-18be-46e9-b761-04106fad767e","resolution":{"observed_at":"2026-05-17T05:09:04.048673Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2601.04442","last_updated":"2026-04-15T06:39:57Z","snapshot_observed_at":"2026-07-06T22:41:05.793337Z","submitted_at":"2026-01-07T23:05:17Z","title":"Addressing Overthinking in Large Vision-Language Models via Gated Perception-Reasoning Optimization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:52.052810Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2601.04442"},"observation_digest":"sha256:203a9187c1fc96e4015b74f7f6ea1ba39bec4854d36f4f1e2f99a29f62fab7e6","observation_id":"3abf123a-2591-4894-920f-4ff320b2353d","resolution":{"observed_at":"2026-05-16T16:08:04.410716Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2601.13606","last_updated":"2026-04-29T05:49:25Z","snapshot_observed_at":"2026-07-06T22:42:12.887517Z","submitted_at":"2026-01-20T05:11:44Z","title":"ChartVerse: Scaling Chart Reasoning via Reliable Programmatic Synthesis from Scratch","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T13:12:01.889341Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2601.13606"},"observation_digest":"sha256:4bfa8c80dd2ce33e6589cd5f82733a7370e78640df794f0d74690aa1be910f03","observation_id":"6ff6ff25-35b0-498f-9c44-152740a151c8","resolution":{"observed_at":"2026-05-16T13:12:54.723766Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-14T23:22:13.847876Z","title":"Dynamath: A dynamic visual bench- mark for evaluating mathematical reasoning robustness of vision language models.arXiv preprint arXiv:2411.00836,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.10757","last_updated":"2026-06-20T10:12:15Z","snapshot_observed_at":"2026-08-08T05:35:24.617237Z","submitted_at":"2026-03-11T13:32:58Z","title":"CodePercept: Code-Grounded Visual STEM Perception for MLLMs","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-14T23:22:13.847876Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2603.10757"},"observation_digest":"sha256:3ab9ef3ea0cd2df3af70233caac140120c479a4020870b9fcc60ac8698a0971c","observation_id":"d81264c5-2706-49e1-bb91-813a388323b3","resolution":{"observed_at":"2026-07-14T23:22:13.847876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2603.20633","last_updated":"2026-04-17T08:57:17Z","snapshot_observed_at":"2026-07-06T22:49:57.103822Z","submitted_at":"2026-03-21T04:03:45Z","title":"Seed1.8 Model Card: Towards Generalized Real-World Agency","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-15T07:44:02.827006Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2603.20633"},"observation_digest":"sha256:d146add56ffab772b8bea7bf25924975cbeed198c17f5cf3d4292c927fed6ddb","observation_id":"583be613-923c-472f-96ff-0a2bc5223d62","resolution":{"observed_at":"2026-05-15T07:45:14.496421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2604.08545","last_updated":"2026-04-09T17:59:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-09T17:59:57Z","title":"Act Wisely: Cultivating Meta-Cognitive Tool Use in Agentic Multimodal Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T18:35:21.514502Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2604.08545"},"observation_digest":"sha256:4be6ed0ec40fe54107e740d477bc8507200c1c7b857b66a37f39430aa0355c2c","observation_id":"367a7780-a059-4402-9a3c-a76e46315220","resolution":{"observed_at":"2026-05-11T00:20:53.738571Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2604.12358","last_updated":"2026-04-15T17:43:53Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T06:48:31Z","title":"Why and When Visual Token Pruning Fails? A Study on Relevant Visual Information Shift in MLLMs Decoding","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-10T14:50:37.022338Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2604.12358"},"observation_digest":"sha256:e69b2e3d13dbe91e19b3f9294664d7a747b6c70139d61e7d36339c7f7d63ea80","observation_id":"7b7096a6-de08-413d-9bd5-22762d1f2f95","resolution":{"observed_at":"2026-05-11T11:31:01.518013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2604.19503","last_updated":"2026-05-09T05:54:49Z","snapshot_observed_at":"2026-08-06T04:17:17.024078Z","submitted_at":"2026-04-21T14:22:04Z","title":"ReaLB: Real-Time Load Balancing for Multimodal MoE Inference","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:42.529129Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2604.19503"},"observation_digest":"sha256:fab47f7e44eea163587679cd3f5937607dfe61b1afe681ba8523bc01a0ef2cfd","observation_id":"a5a5f8eb-ce0c-4d76-8b63-65250ae29914","resolution":{"observed_at":"2026-05-12T08:01:29.079542Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2605.01327","last_updated":"2026-05-07T08:09:44Z","snapshot_observed_at":"2026-07-29T17:18:59.626285Z","submitted_at":"2026-05-02T08:47:45Z","title":"Segment-Aligned Policy Optimization for Multi-Modal Reasoning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-09T14:44:31.160543Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2605.01327"},"observation_digest":"sha256:5b69226b2f6fc9db208569dd4e63b6deb98eb106b22b6577c916aeb3b7f1c891","observation_id":"574323eb-0efb-4a20-8e7b-e5dc35346274","resolution":{"observed_at":"2026-05-11T16:51:07.917445Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2605.03677","last_updated":"2026-07-06T06:34:16Z","snapshot_observed_at":"2026-08-03T02:52:57.588273Z","submitted_at":"2026-05-05T12:15:21Z","title":"Uni-OPD: Unifying On-Policy Distillation with a Dual-Perspective Recipe","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-07T17:00:49.448352Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2605.03677"},"observation_digest":"sha256:e424acc807cb7337da2441bc1a22c9da750ca93e91714c0fc0cb78223069d0a0","observation_id":"e8a2003e-ca14-4039-aa51-13d48769aa30","resolution":{"observed_at":"2026-05-11T23:26:16.356487Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2605.19436","last_updated":"2026-05-19T06:46:19Z","snapshot_observed_at":"2026-07-06T23:30:11.337726Z","submitted_at":"2026-05-19T06:46:19Z","title":"CEPO: RLVR Self-Distillation using Contrastive Evidence Policy Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T07:25:34.637803Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2605.19436"},"observation_digest":"sha256:d72c75ff8a6186e1f1feac30481bca6a217c862aedcd5f7548c1ddb501139e39","observation_id":"94f731f4-8d62-4817-aa77-2f3d071c6fc5","resolution":{"observed_at":"2026-05-20T07:28:06.725569Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2605.19852","last_updated":"2026-06-03T11:11:28Z","snapshot_observed_at":"2026-07-06T23:30:30.141040Z","submitted_at":"2026-05-19T13:44:26Z","title":"Are Tools Always Beneficial? Learning to Invoke Tools Adaptively for Dual-Mode Multimodal LLM Reasoning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-20T06:16:47.650748Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2605.19852"},"observation_digest":"sha256:24baf400a73a6ffa80e3f2fd646e0199d2a0d38d894898db66a8d3a111b4f77d","observation_id":"77cdde0a-33d9-4c61-8880-9092fa519084","resolution":{"observed_at":"2026-05-20T06:18:05.215516Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2606.01599","last_updated":"2026-06-01T02:52:49Z","snapshot_observed_at":"2026-07-06T23:42:07.508474Z","submitted_at":"2026-06-01T02:52:49Z","title":"TRON: Targeted Rule-Verifiable Online Environments for Visual Reasoning RL","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T14:55:07.045625Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2606.01599"},"observation_digest":"sha256:bbd7985caef2a69a124c1e1972ae4c97073b10d77484858adce1bbed70f6a155","observation_id":"62ba18d2-50e4-444a-b080-abbb816179e0","resolution":{"observed_at":"2026-07-01T22:56:19.945174Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2606.08034","last_updated":"2026-06-06T07:51:52Z","snapshot_observed_at":"2026-07-06T23:47:33.680573Z","submitted_at":"2026-06-06T07:51:52Z","title":"Sci-Rho: A Multilingual Visually-Grounded Symbolic Benchmark for STEM Problems","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-06-27T20:11:02.445626Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2606.08034"},"observation_digest":"sha256:798f0c67d64539db4ef3a2fec9753bdc26b952e10caed235abaa8134213e3906","observation_id":"bcdf8a07-284a-487e-8e7d-6cbf472d189b","resolution":{"observed_at":"2026-07-02T20:47:22.863324Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2606.08231","last_updated":"2026-06-06T15:39:29Z","snapshot_observed_at":"2026-08-07T16:58:05.550639Z","submitted_at":"2026-06-06T15:39:29Z","title":"Test-Time Scaling in Multimodal Foundation Models: A Comprehensive Survey of Generation and Reasoning","version":1},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-06-27T19:36:57.231932Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2606.08231"},"observation_digest":"sha256:7470da3c06c2b68baceb0a5dc2c7f45def15c184e23ccc69dfe1342573b4804b","observation_id":"7e73f050-7a90-42da-aa3d-e2d49f48d2ae","resolution":{"observed_at":"2026-07-02T21:37:25.272238Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2606.10651","last_updated":"2026-06-09T09:58:08Z","snapshot_observed_at":"2026-07-06T23:49:51.672382Z","submitted_at":"2026-06-09T09:58:08Z","title":"Kwai Keye-VL-2.0 Technical Report","version":1},"reference_index":113,"source":"arxiv_source","source_observed_at":"2026-06-27T13:53:10.352603Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2606.10651"},"observation_digest":"sha256:c187996872c20c0683266a76e99e595286dad386a65309776f57820a9bf38d98","observation_id":"2eac8e13-ee06-4d26-acba-29fdfa65db91","resolution":{"observed_at":"2026-07-03T04:27:37.126894Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2606.18216","last_updated":"2026-06-16T17:46:02Z","snapshot_observed_at":"2026-07-06T23:53:40.698123Z","submitted_at":"2026-06-16T17:46:02Z","title":"Zone of Proximal Policy Optimization: Teacher in Prompts, Not Gradients","version":1},"reference_index":133,"source":"pdf_text","source_observed_at":"2026-06-27T01:08:52.981296Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2606.18216"},"observation_digest":"sha256:97112383c9dd6730079fada5e9555c773165df386279d8cb1203c303fee21200","observation_id":"735cf272-874d-4908-b4d9-26409cdabd90","resolution":{"observed_at":"2026-07-03T20:48:56.043493Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2606.24253","last_updated":"2026-06-26T09:37:54Z","snapshot_observed_at":"2026-08-08T09:42:45.507846Z","submitted_at":"2026-06-23T07:42:22Z","title":"TuringViT: Making SOTA Vision Transformers Accessible to All","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-29T05:32:26.746776Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2606.24253"},"observation_digest":"sha256:f5de753e5664f66d97e996f418e1f9f9f60397ad85606904b0b3a7ae2fbc294f","observation_id":"203aa784-5ef5-4555-9b26-f50f1b9fd1b7","resolution":{"observed_at":"2026-06-29T15:03:32.172756Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":"2411.00836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-03T20:48:56.041994Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"1b71954f-ae5f-4a76-9175-6e677f7b4c85","year":2024},"citing_paper":{"arxiv_id":"2607.00248","last_updated":"2026-06-30T22:57:43Z","snapshot_observed_at":"2026-08-03T15:00:12.134373Z","submitted_at":"2026-06-30T22:57:43Z","title":"Seed2.0 Model Card: Towards Intelligence Frontier for Real-World Complexity","version":1},"reference_index":150,"source":"pdf_text","source_observed_at":"2026-07-02T18:57:46.841456Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2607.00248"},"observation_digest":"sha256:ea269b4788716f108e8ff0c5e06045a3935ff21f8c9ab0d722b05dfcf6128062","observation_id":"0d3444e8-d223-4509-9899-5de7a94a8763","resolution":{"observed_at":"2026-07-02T19:07:17.456810Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-07-14T01:07:06.861298Z","title":"×1×1−!\"×(2−1)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10004","last_updated":"2026-07-10T22:03:01Z","snapshot_observed_at":"2026-08-03T02:26:02.235143Z","submitted_at":"2026-07-10T22:03:01Z","title":"Model Guides You How to Draw: Adaptive Visual Gating for Unified Multimodal Reasoning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-14T01:07:06.861298Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2607.10004"},"observation_digest":"sha256:caffcda1755042ea845504442f931490c0f6363815244a09a358622ac7d5c3b9","observation_id":"ee54c62c-eef4-4ccd-ac6c-f89ced35fad5","resolution":{"observed_at":"2026-07-14T01:07:06.861298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-04T02:46:49.739428Z","title":"Pan Lu, Swaroop Mishra, Tony Xia, Liang Qiu, Kai-Wei Chang, Song-Chun Zhu, Oyvind Tafjord, Peter Clark, and Ashwin Kalyan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00013","last_updated":"2026-06-24T13:23:33Z","snapshot_observed_at":"2026-08-06T23:11:31.052908Z","submitted_at":"2026-06-24T13:23:33Z","title":"What Transfers from Text to Vision? Capability Scaling Laws and Transfer Dynamics for VLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T02:46:49.739428Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2608.00013"},"observation_digest":"sha256:8f445405eadc7c11bead92470ccc16720c0f17e91a7fa08b29ad56ef297d879e","observation_id":"a6346352-c820-4d72-88fc-7d33e3b9970a","resolution":{"observed_at":"2026-08-04T02:46:49.739428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00836","snapshot_observed_at":"2026-08-05T00:49:46.500785Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00868","last_updated":"2026-08-04T07:47:28Z","snapshot_observed_at":"2026-08-08T09:46:03.577011Z","submitted_at":"2026-08-01T21:06:17Z","title":"MIDAL: A Dataset of Math Image Descriptions for Accessible Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T00:49:46.500785Z"},"links":{"cited_paper":"/paper/2411.00836","citing_paper":"/paper/2608.00868"},"observation_digest":"sha256:180e9c7752a3f0a1c5ab7ac5e2b883e97c25107482132f14cc09636972253238","observation_id":"d9ba0465-73f0-47d9-a34b-4f562c052503","resolution":{"observed_at":"2026-08-05T00:49:46.500785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.00836/citation-record","integrity":"/paper/2411.00836/integrity","json":"/paper/2411.00836/citation-record.json","paper":"/paper/2411.00836"},"outbound":[],"paper":{"arxiv_id":"2411.00836","last_updated":"2025-02-24T06:55:22Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-29T17:29:19Z","title":"DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 41 inbound Pith citation observations for arXiv:2411.00836."}