{"as_of":"2026-08-09T21:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b7f8c36b1089f82ea0ec94d4e1567149df008b20ef12daed35ac166b34379e35","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T06:01:13.371992Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T20:18:57.684839Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.17294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-03T20:18:57.684839Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":"0eaf9e93-7c20-4692-bd9a-2257336131c0","year":2024},"citing_paper":{"arxiv_id":"2410.04509","last_updated":"2026-04-20T02:03:24Z","snapshot_observed_at":"2026-08-02T21:14:32.237997Z","submitted_at":"2024-10-06T14:59:09Z","title":"ErrorRadar: Benchmarking Complex Mathematical Reasoning of Multimodal Large Language Models Via Error Detection","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-23T20:10:59.264484Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2410.04509"},"observation_digest":"sha256:07f50a9ff433bcee07761acf8105fe2e952728c5cc28070acb9aa9d7bcc2145c","observation_id":"dd81da68-afc6-487a-b30d-16383dfef233","resolution":{"observed_at":"2026-05-23T20:13:24.675026Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.17294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-03T20:18:57.684839Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":"0eaf9e93-7c20-4692-bd9a-2257336131c0","year":2024},"citing_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-11T10:09:21.542356Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2412.10302"},"observation_digest":"sha256:e49986628306a413cc3fbca4c7ee903c7f9b8e0f44f1de849977f5a70d0425d8","observation_id":"f9ca6fa3-7e92-4462-95f5-1f0f93d2abab","resolution":{"observed_at":"2026-05-11T10:09:25.131351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-09T06:01:13.371992Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04371","last_updated":"2025-02-05T11:28:11Z","snapshot_observed_at":"2026-08-09T05:54:22.550320Z","submitted_at":"2025-02-05T11:28:11Z","title":"PerPO: Perceptual Preference Optimization via Discriminative Rewarding","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-09T06:01:13.371992Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2502.04371"},"observation_digest":"sha256:ff1b41c62e42016e921ad8ee07a99d5cdbbf0906a35284a84c79aa3240900992","observation_id":"ec183003-4649-427e-9e08-274794459061","resolution":{"observed_at":"2026-08-09T06:01:13.371992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T20:06:36.653295Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09925","last_updated":"2025-02-14T05:32:46Z","snapshot_observed_at":"2026-08-08T17:49:07.644342Z","submitted_at":"2025-02-14T05:32:46Z","title":"TaskGalaxy: Scaling Multi-modal Instruction Fine-tuning with Tens of Thousands Vision Task Types","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T20:06:36.653295Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2502.09925"},"observation_digest":"sha256:13ce049b0c9fb341656c3278141081b007988cf53314f46636d48d47b252e0a5","observation_id":"4d15d3ad-3a5f-49ce-92f3-9463fdbcb74d","resolution":{"observed_at":"2026-08-07T20:06:36.653295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.17294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-03T20:18:57.684839Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":"0eaf9e93-7c20-4692-bd9a-2257336131c0","year":2024},"citing_paper":{"arxiv_id":"2503.16549","last_updated":"2026-04-18T11:44:37Z","snapshot_observed_at":"2026-08-08T08:24:44.422314Z","submitted_at":"2025-03-19T11:46:19Z","title":"MathFlow: Enhancing the Perceptual Flow of MLLMs for Visual Mathematical Problems","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-22T22:55:34.238427Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2503.16549"},"observation_digest":"sha256:17e5f186a70dac10c1ad41d2fd6d0d1e218d2ce4045aebd0a1ee4fd74dc901c6","observation_id":"864f180e-87f7-4e60-b190-e2b7b432ba0a","resolution":{"observed_at":"2026-05-22T22:57:13.279934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.17294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-03T20:18:57.684839Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":"0eaf9e93-7c20-4692-bd9a-2257336131c0","year":2024},"citing_paper":{"arxiv_id":"2503.17352","last_updated":"2025-11-11T08:13:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-21T17:52:43Z","title":"OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-19T06:59:03.112252Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2503.17352"},"observation_digest":"sha256:e475701e1bf9736961009932e48e9717d6e79df6acb8dbf13acb67e9c6c1425c","observation_id":"3aa91544-79f8-4f2a-a381-38533149a20e","resolution":{"observed_at":"2026-05-19T06:59:03.252139Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.17294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-03T20:18:57.684839Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":"0eaf9e93-7c20-4692-bd9a-2257336131c0","year":2024},"citing_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-05-10T13:41:07.991012Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2504.10479"},"observation_digest":"sha256:7fc7ea97cfcb8cc9f32698c3c53514dec7219c3692e89bd6f8cbc77555ef36a7","observation_id":"3a105740-b880-4d6d-b43a-5e278e7fa70b","resolution":{"observed_at":"2026-05-10T13:41:08.083075Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T15:08:50.937309Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16148","last_updated":"2025-05-22T02:46:08Z","snapshot_observed_at":"2026-08-09T08:13:03.628091Z","submitted_at":"2025-05-22T02:46:08Z","title":"NAN: A Training-Free Solution to Coefficient Estimation in Model Merging","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:08:50.937309Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2505.16148"},"observation_digest":"sha256:89ed98e94201d7a3ade83e04f15859cde0fb0cf0c856de167f005f7f964d5042","observation_id":"c1cae2d9-76c8-44c2-b3d7-bf481fe01269","resolution":{"observed_at":"2026-08-07T15:08:50.937309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T14:37:52.139069Z","title":"Math- llava: Bootstrapping mathematical reasoning for multimodal large language models.arXiv preprint arXiv:2406.17294,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18115","last_updated":"2025-05-23T17:14:12Z","snapshot_observed_at":"2026-08-08T00:41:58.877205Z","submitted_at":"2025-05-23T17:14:12Z","title":"Instructify: Demystifying Metadata to Visual Instruction Tuning Data Conversion","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:37:52.139069Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2505.18115"},"observation_digest":"sha256:821041712138909bdbf0e36a4aaa6f1162e604a8bd2a4afa5113491f6e2b01af","observation_id":"004772e0-2b2d-4d52-b3ea-10f23bce2144","resolution":{"observed_at":"2026-08-07T14:37:52.139069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T13:59:39.820900Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20289","last_updated":"2025-07-19T05:24:59Z","snapshot_observed_at":"2026-08-09T06:01:05.298875Z","submitted_at":"2025-05-26T17:59:17Z","title":"VisualToolAgent (VisTA): A Reinforcement Learning Framework for Visual Tool Selection","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:59:39.820900Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2505.20289"},"observation_digest":"sha256:689fd5a9e737f8eded42ec113f3153149481a7b0a24ef22235c737942c66a0df","observation_id":"3006adf5-42af-4746-b61d-4e572fd8820a","resolution":{"observed_at":"2026-08-07T13:59:39.820900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T13:12:56.479241Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22334","last_updated":"2025-07-23T07:37:08Z","snapshot_observed_at":"2026-08-08T13:10:29.457567Z","submitted_at":"2025-05-28T13:21:38Z","title":"Advancing Multimodal Reasoning via Reinforcement Learning with Cold Start","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:56.479241Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2505.22334"},"observation_digest":"sha256:c7c7b3df9a90260dc1f92b96da6327583f1a1f9fe0b52b7d2403cd2b5e36a024","observation_id":"06a8e1bc-ed18-460e-ac83-75c63b3af582","resolution":{"observed_at":"2026-08-07T13:12:56.479241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T11:35:46.632301Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.632301Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:a8175f905862d9d882d88399a044c7e138328a7de962a790338baaf0bf408b66","observation_id":"4a3f3a05-f5fc-4a3f-a88d-7f220ec9a4a6","resolution":{"observed_at":"2026-08-07T11:35:46.632301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T10:54:02.843028Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models.arXiv preprint arXiv:2406.17294, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04088","last_updated":"2025-06-04T15:46:30Z","snapshot_observed_at":"2026-08-08T10:57:58.673564Z","submitted_at":"2025-06-04T15:46:30Z","title":"Multimodal Tabular Reasoning with Privileged Structured Information","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T10:54:02.843028Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.04088"},"observation_digest":"sha256:47bcdea18950d404b647cf54de08a694bed167c2a4ac90aaeb8c409036ea5769","observation_id":"205184d9-3108-4047-bb78-d63bfbdec772","resolution":{"observed_at":"2026-08-07T10:54:02.843028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T10:52:35.639817Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04141","last_updated":"2026-07-20T11:08:55Z","snapshot_observed_at":"2026-08-08T00:41:56.834898Z","submitted_at":"2025-06-04T16:33:41Z","title":"MMR-V: What's Left Unsaid? A Benchmark for Multimodal Deep Reasoning in Videos","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:52:35.639817Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.04141"},"observation_digest":"sha256:b0a302be031e2dba49dfc8cddebdae6a100edf62c08719d98242d3e08119f412","observation_id":"dc10fc38-d2e6-452b-a61b-36f266a4b83d","resolution":{"observed_at":"2026-08-07T10:52:35.639817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T10:28:52.462846Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models.arXiv preprint arXiv:2406.17294, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05331","last_updated":"2025-06-05T17:59:02Z","snapshot_observed_at":"2026-08-09T02:08:19.234840Z","submitted_at":"2025-06-05T17:59:02Z","title":"MINT-CoT: Enabling Interleaved Visual Tokens in Mathematical Chain-of-Thought Reasoning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.462846Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.05331"},"observation_digest":"sha256:f3eb0a6d445b63643c37823b285dd5d693db181e9a3d28dd6e169b6897eb7de8","observation_id":"fc80feab-9e9f-42d6-b697-88ad8fcfc31a","resolution":{"observed_at":"2026-08-07T10:28:52.462846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T06:08:26.344518Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models.arXiv preprint arXiv:2406.17294, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-09T18:24:38.296461Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.344518Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:cec7af413ea02037d65ed89180e6235705d104484553b3f880351968e6b4f388","observation_id":"2bfd9f50-6f4c-412d-a024-af64874f16a4","resolution":{"observed_at":"2026-08-07T06:08:26.344518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.17294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-03T20:18:57.684839Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":"0eaf9e93-7c20-4692-bd9a-2257336131c0","year":2024},"citing_paper":{"arxiv_id":"2506.06856","last_updated":"2026-05-06T17:36:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-07T16:37:46Z","title":"Vision-EKIPL: External Knowledge-Infused Policy Learning for Visual Reasoning","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-19T10:34:48.849524Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.06856"},"observation_digest":"sha256:645d6fbb94822f63c0d26faea48cc58c1e39451cdcec26ccd4c43a4ec4a94441","observation_id":"adac4d99-4cb3-4a53-9f90-984df78a8027","resolution":{"observed_at":"2026-05-19T10:37:14.976431Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T05:38:57.238958Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:57.238958Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:4b2275277de415d8f9ccd75d810b95ec3521d80537292aac12e2272851acfd26","observation_id":"87b1b2c3-68b9-4d65-afbc-738f1b3f6947","resolution":{"observed_at":"2026-08-07T05:38:57.238958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T11:19:03.417391Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14805","last_updated":"2025-08-12T17:07:53Z","snapshot_observed_at":"2026-08-08T00:05:33.094743Z","submitted_at":"2025-06-03T13:44:14Z","title":"Argus Inspection: Do Multimodal Large Language Models Possess the Eye of Panoptes?","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:19:03.417391Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.14805"},"observation_digest":"sha256:d8cc1e12d8926197e074de230d97ced1f35e7f5080f8f9dd4dbd9d5333862468","observation_id":"fc06b046-7f66-4f8b-9f1a-7fac3ce8783e","resolution":{"observed_at":"2026-08-07T11:19:03.417391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-06T21:32:23.844440Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23940","last_updated":"2025-07-01T03:26:52Z","snapshot_observed_at":"2026-08-07T22:13:54.563047Z","submitted_at":"2025-06-30T15:07:41Z","title":"Graft: Integrating the Domain Knowledge via Efficient Parameter Synergy for MLLMs","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:32:23.844440Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.23940"},"observation_digest":"sha256:a09fde5a81d5220bfcaf8ae353509a8c7f56569f1aea54e9b755ba178f01ab0d","observation_id":"e92b9496-f065-4349-a926-08d18810bccf","resolution":{"observed_at":"2026-08-06T21:32:23.844440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-06T20:53:08.277308Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01643","last_updated":"2025-07-02T12:17:23Z","snapshot_observed_at":"2026-08-09T03:13:28.261088Z","submitted_at":"2025-07-02T12:17:23Z","title":"SAILViT: Towards Robust and Generalizable Visual Backbones for MLLMs via Gradual Feature Refinement","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T20:53:08.277308Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2507.01643"},"observation_digest":"sha256:0412a0eb87b4afed5338e9bed861ea62e4472daee068ac19dcf62168f133a2cf","observation_id":"67b0689a-37ba-48e2-97be-68b05328c0e7","resolution":{"observed_at":"2026-08-06T20:53:08.277308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-06T20:25:21.524638Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02804","last_updated":"2026-06-28T12:40:31Z","snapshot_observed_at":"2026-08-08T16:13:23.244408Z","submitted_at":"2025-07-03T17:07:20Z","title":"Multimodal Mathematical Reasoning with Diverse Solving Perspective","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:25:21.524638Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2507.02804"},"observation_digest":"sha256:e8a28c8998f2662a0aa20a2c5a8657ae8b3ed8616f8d805257fc36f67d726dd2","observation_id":"1e504bdb-2403-4050-8bdb-ae16c5b998c8","resolution":{"observed_at":"2026-08-06T20:25:21.524638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-06T21:19:37.737245Z","title":"arXiv preprint arXiv:2406.17294 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-07T08:32:24.456726Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.737245Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:5c4e2584b4dc2d10ba58e7bbbd98ea3dc72549fd17809ab61daae036c1c17a48","observation_id":"7c2861a9-00e8-44db-8dbe-f02ff5886416","resolution":{"observed_at":"2026-08-06T21:19:37.737245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-06T00:59:53.128918Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04088","last_updated":"2025-08-07T03:52:48Z","snapshot_observed_at":"2026-08-08T12:10:28.774282Z","submitted_at":"2025-08-06T05:10:29Z","title":"GM-PRM: A Generative Multimodal Process Reward Model for Multimodal Mathematical Reasoning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T00:59:53.128918Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2508.04088"},"observation_digest":"sha256:a2610ede679d701d975c6d5da27c5c59fc82180e2d44572bfb40df470f9e7fcb","observation_id":"af33b033-350c-4a9b-8905-1a8d36693099","resolution":{"observed_at":"2026-08-06T00:59:53.128918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.17294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-03T20:18:57.684839Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":"0eaf9e93-7c20-4692-bd9a-2257336131c0","year":2024},"citing_paper":{"arxiv_id":"2601.14044","last_updated":"2026-01-20T15:00:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-20T15:00:15Z","title":"Weather-R1: Logically Consistent Reinforcement Fine-Tuning for Multimodal Reasoning in Meteorology","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T12:36:23.661583Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2601.14044"},"observation_digest":"sha256:29d213f40d52805d373cd087d2f23b31d95dd4747751e873296a7ae0d1b6afdd","observation_id":"159c8c8e-6b7f-45a2-8da3-6c3c0d47b2d4","resolution":{"observed_at":"2026-05-16T12:37:53.041796Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.17294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-03T20:18:57.684839Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":"0eaf9e93-7c20-4692-bd9a-2257336131c0","year":2024},"citing_paper":{"arxiv_id":"2604.17041","last_updated":"2026-04-18T15:52:42Z","snapshot_observed_at":"2026-08-03T02:43:16.361076Z","submitted_at":"2026-04-18T15:52:42Z","title":"SIF: Semantically In-Distribution Fingerprints for Large Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T06:59:54.879224Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2604.17041"},"observation_digest":"sha256:a616e807c7b4c4a1c680a80d2e3e1fc2e364dec24a9b776e62ac09310ec13319","observation_id":"ad49d3dd-93b9-4c84-8385-6b0f3262e031","resolution":{"observed_at":"2026-05-10T07:01:49.189464Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.17294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-03T20:18:57.684839Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":"0eaf9e93-7c20-4692-bd9a-2257336131c0","year":2024},"citing_paper":{"arxiv_id":"2606.01599","last_updated":"2026-06-01T02:52:49Z","snapshot_observed_at":"2026-07-06T23:42:07.508474Z","submitted_at":"2026-06-01T02:52:49Z","title":"TRON: Targeted Rule-Verifiable Online Environments for Visual Reasoning RL","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T14:55:07.045625Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2606.01599"},"observation_digest":"sha256:93b1aed99db4fad99748b8c3ed7df66b3540a0ae8309822d6f4f58905ef862e0","observation_id":"002f24ff-522b-453e-9e95-41668efda380","resolution":{"observed_at":"2026-07-01T22:56:19.907338Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.17294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-03T20:18:57.684839Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":"0eaf9e93-7c20-4692-bd9a-2257336131c0","year":2024},"citing_paper":{"arxiv_id":"2606.09092","last_updated":"2026-06-08T06:42:12Z","snapshot_observed_at":"2026-07-06T23:48:30.569726Z","submitted_at":"2026-06-08T06:42:12Z","title":"From Shortcuts to Reasoning: Robust Post-Training of Theory of Mind with Reinforcement Learning","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-06-27T17:42:38.122144Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2606.09092"},"observation_digest":"sha256:1c488dccbed70bd5f946d11494af36e631b19e08591b5572a4a03e5c369bb0f3","observation_id":"613b6fbe-c7d2-4e02-b011-9a0ccc5d1820","resolution":{"observed_at":"2026-07-02T23:57:28.242390Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.17294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-03T20:18:57.684839Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":"0eaf9e93-7c20-4692-bd9a-2257336131c0","year":2024},"citing_paper":{"arxiv_id":"2606.11470","last_updated":"2026-06-09T21:59:37Z","snapshot_observed_at":"2026-07-06T23:50:35.052764Z","submitted_at":"2026-06-09T21:59:37Z","title":"The Periodic Table of LLM Reasoning: A Structured Survey of Reasoning Paradigms, Methods, and Failure Modes","version":1},"reference_index":210,"source":"arxiv_source","source_observed_at":"2026-06-27T12:59:51.091008Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2606.11470"},"observation_digest":"sha256:949e24a5591eaa6b8948f5e7f5c411cae0340acd834108810271fd479f7e6675","observation_id":"6fe9fe59-b4e2-4416-9349-b71951a52d65","resolution":{"observed_at":"2026-07-03T05:57:41.471077Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.17294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-03T20:18:57.684839Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":"0eaf9e93-7c20-4692-bd9a-2257336131c0","year":2024},"citing_paper":{"arxiv_id":"2606.17888","last_updated":"2026-06-16T13:09:32Z","snapshot_observed_at":"2026-08-08T01:57:17.698279Z","submitted_at":"2026-06-16T13:09:32Z","title":"MathVis-Fine: Aligning Visual Supervision with Necessity via Progressive Dependency-Guided Training for Multimodal Mathematical Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-27T01:23:40.564561Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2606.17888"},"observation_digest":"sha256:73d6261f43f87a5e1825ed77e03f0ded00929fe8051246bbd8543fc602f2d48d","observation_id":"d1911d2f-da35-4d8f-92fa-e1d7675d51b2","resolution":{"observed_at":"2026-07-03T20:18:57.688190Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-07-12T04:17:40.198357Z","title":"arXiv preprint arXiv:2406.17294 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03184","last_updated":"2026-07-03T10:42:34Z","snapshot_observed_at":"2026-08-05T15:07:18.952856Z","submitted_at":"2026-07-03T10:42:34Z","title":"BVS: Bayesian Visual Search with Multimodal Large Language Model for Fine-grained Perception","version":1},"reference_index":167,"source":"arxiv_source","source_observed_at":"2026-07-12T04:17:40.198357Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2607.03184"},"observation_digest":"sha256:ff8889e14b88aa6c52de5f1b8309f0715f165a1f9573852a54357028388e45a3","observation_id":"61feef39-7089-43b7-b726-4a922999a19e","resolution":{"observed_at":"2026-07-12T04:17:40.198357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-01T07:15:04.791349Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21552","last_updated":"2026-07-23T17:35:56Z","snapshot_observed_at":"2026-08-07T05:31:06.665189Z","submitted_at":"2026-07-23T17:35:56Z","title":"MIRROR: Learning from the Other View for Multi-Modal Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T07:15:04.791349Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2607.21552"},"observation_digest":"sha256:b046cf40694a0b9583a364f43fcf3f8a92caa4450dd0842639577b34f0d3b056","observation_id":"3e71a487-fe57-4d44-8b08-4a006cbca7b2","resolution":{"observed_at":"2026-08-01T07:15:04.791349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.17294/citation-record","integrity":"/paper/2406.17294/integrity","json":"/paper/2406.17294/citation-record.json","paper":"/paper/2406.17294"},"outbound":[],"paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 32 inbound Pith citation observations for arXiv:2406.17294."}