{"as_of":"2026-08-08T11:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5684a87404993f7b10f86ef9acd9c6567f2b0b945dadbd926c698b01363a0245","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:47:36.084003Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T13:07:41.729629Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T10:32:44.942041Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17609","snapshot_observed_at":"2026-08-03T13:07:41.729629Z","title":"Decoupled visual interpretation and linguistic reasoning for math problem solving.arXiv preprint arXiv:2505.17609, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.00501","last_updated":"2026-05-26T22:35:38Z","snapshot_observed_at":"2026-08-03T16:22:18.153593Z","submitted_at":"2026-01-01T22:48:26Z","title":"CPPO: Contrastive Perception Policy Optimization for VLM Agents","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T13:07:41.729629Z"},"links":{"cited_paper":"/paper/2505.17609","citing_paper":"/paper/2601.00501"},"observation_digest":"sha256:55242902c5b599c02f005fbd0f806d8f0a640ece887fd6bf0e90701c162d8f64","observation_id":"810f532a-3356-4d45-b17f-066ddf3c9118","resolution":{"observed_at":"2026-08-03T13:07:41.729629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"cited_work":{"arxiv_id":"2505.17609","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17609","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decoupled visual interpretation and linguistic reasoning for math problem solving","venue":null,"work_id":"1f89a9fd-5771-4998-bf5d-9a783e810f83","year":2025},"citing_paper":{"arxiv_id":"2601.21164","last_updated":"2026-05-09T13:45:18Z","snapshot_observed_at":"2026-07-31T16:07:22.169895Z","submitted_at":"2026-01-29T02:03:33Z","title":"Concise Geometric Description as a Bridge: Unleashing the Potential of LLM for Plane Geometry Problem Solving","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T10:31:06.712428Z"},"links":{"cited_paper":"/paper/2505.17609","citing_paper":"/paper/2601.21164"},"observation_digest":"sha256:1ce5b3a4cc2980380a576af683820416c7aee2e01c191aa7ba5cc1d777198766","observation_id":"87c3c1dd-5e30-4533-b455-2fdf424e070c","resolution":{"observed_at":"2026-05-16T10:32:44.943620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17609/citation-record","integrity":"/paper/2505.17609/integrity","json":"/paper/2505.17609/citation-record.json","paper":"/paper/2505.17609"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:30.291808Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:30.291808Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:1f5a4e7e4fcf573b4d327620d6118877e08134305b4c31f76ee1ac57540c5396","observation_id":"a7cf1643-08b3-4264-8a0d-34ff03143c1a","resolution":{"observed_at":"2026-08-07T14:47:30.291808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T14:47:30.390793Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:30.390793Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:f31d61912b1da153857362e7f2d5357fb5da8832d1e9fbaef2e939d4c7266077","observation_id":"533f91e3-e6e0-40e3-a99f-ccfd8133d26c","resolution":{"observed_at":"2026-08-07T14:47:30.390793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20330","last_updated":"2024-04-09T15:17:50Z","snapshot_observed_at":"2026-08-07T12:15:30.838846Z","submitted_at":"2024-03-29T17:59:34Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20330","snapshot_observed_at":"2026-08-07T14:47:30.484426Z","title":"Are we on the right way for evaluating large vision-language models? arXiv preprint arXiv:2403.20330,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:30.484426Z"},"links":{"cited_paper":"/paper/2403.20330","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:a69de594f1dc16d5ab352938e90c2188258d9b3cb92773e09fb4e49186a6c760","observation_id":"552ad251-ec16-47e3-8ae4-0f615f32382f","resolution":{"observed_at":"2026-08-07T14:47:30.484426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:42.955044Z","title":"Comt: A novel benchmark for chain of multi-modal thought on large vision- language models, 2024","venue":null,"work_id":"5daea41c-13cf-4aa8-b4c5-45f4203dd859","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:30.637752Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:209ac5943baad528bafbceaf12bccf0508fab51a0f41de39265483c67f3bbf85","observation_id":"56b1ef94-3b59-4823-b454-ed683db651db","resolution":{"observed_at":"2026-08-07T14:47:43.045383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:42.778166Z","title":"R-cot: Reverse chain-of-thought problem generation for geometric reasoning in large multimodal models, 2024","venue":null,"work_id":"e271abfa-d204-4049-a280-16b3ea58d71a","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:30.759765Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:5d2e656ed1fad41b394805803a966854c9b2e06176f1e8a27b517c91a69cf40f","observation_id":"d4861593-0ad5-486e-aa9f-176f8dcd5bd1","resolution":{"observed_at":"2026-08-07T14:47:42.873009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:42.576680Z","title":"G-llava: Solving geomet- ric problem with multi-modal large language model, 2023","venue":null,"work_id":"8b2fafd1-a1f6-424f-93a4-5031f7c8824b","year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:30.892440Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:54db2e287e76e7d95c8365b5002c71da1853aa7d510efd659579dd90e185f07a","observation_id":"0ea2a75a-960a-4a94-a8de-75aa43244682","resolution":{"observed_at":"2026-08-07T14:47:42.677269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:42.365846Z","title":"Interleaved-modal chain-of-thought, 2024","venue":null,"work_id":"7770ca0d-7f6b-4236-971f-40bf8d06a143","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.048269Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:58c318ee35a398ebd4f34e8ae940760ccba9e9fed1f2e0e1dfac1e922a848d50","observation_id":"9edcad66-0962-4658-9157-0d39ca24da16","resolution":{"observed_at":"2026-08-07T14:47:42.476504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:47:31.177597Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.177597Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:27b7e5bd5b88e3dd0afee7ae7a732c0704d595be5e73aaa591a0483a50b6ef4a","observation_id":"c39060a5-ecab-4cc9-b748-7be13bca7710","resolution":{"observed_at":"2026-08-07T14:47:31.177597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:42.122991Z","title":"Infimm-webmath-40b: Ad- vancing multimodal pre-training for enhanced mathematical reasoning, 2024","venue":null,"work_id":"2cd24b88-4577-4600-96d8-2a4b431f5ed6","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.348600Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:74743ed5a66d02b682c06807e9bc3fdf1dfd0b11ed0ae54931225d1e364c5074","observation_id":"42a41d0e-8bde-4065-a0c4-786dc5f47374","resolution":{"observed_at":"2026-08-07T14:47:42.241732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:41.945350Z","title":"Can mllms reason in multimodality? emma: An enhanced multimodal reasoning benchmark, 2025","venue":null,"work_id":"d0dbbc20-d48e-4349-98d6-46f8bcff071d","year":2025},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.462609Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:d5e7cdaa63ad2c026ef564a4552af325f5fb6e1e0ab1a7f353b8efedc58b6106","observation_id":"fe2b4cc8-b3ac-4878-960e-8210d466fed2","resolution":{"observed_at":"2026-08-07T14:47:42.032216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:41.762113Z","title":"V- star: Training verifiers for self-taught reasoners, 2024","venue":null,"work_id":"64516a5d-c240-4b99-a2c5-0c2eb5f29c9f","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.620508Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:9d650f67c0d649dd80205b6a3d5040a8034664a6bc3528d52be411bfa4c52520","observation_id":"1305a56a-5437-46ef-87c5-f29bb8916d3f","resolution":{"observed_at":"2026-08-07T14:47:41.850434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:41.547699Z","title":"Why vision language models struggle with visual arithmetic? to- wards enhanced chart and geometry understanding, 2025","venue":null,"work_id":"9dc6041a-6b15-4e58-8894-116b31e8a258","year":2025},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.727616Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:2ea222ce8b7221febaa39f08845c514285aa93a854cced0ef5c7217e05c0398b","observation_id":"337c9337-9012-49d0-8392-760a73b00c6f","resolution":{"observed_at":"2026-08-07T14:47:41.639160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:41.368872Z","title":"Co-Reyes, Avi Singh, Kate Baumli, Shariq Iqbal, Colton Bishop, Rebecca Roelofs, Lei M","venue":null,"work_id":"efec30ec-eefd-4796-97d4-b4e2bf281fe7","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.876835Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:209f149e6c3c5f6528a13c04827d4fa22530f08fdf5a446d3e6f0f2492daf07b","observation_id":"929b7b64-f18c-47d4-bb38-57102a6fffde","resolution":{"observed_at":"2026-08-07T14:47:41.464081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:31.956475Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.956475Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:d23119682d9b2626528cc24f596a74ef4af3624fae68a030cbf34c33f7c0316a","observation_id":"05f7bccb-0f31-4f0f-a28b-bbdb3b079bc7","resolution":{"observed_at":"2026-08-07T14:47:31.956475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:32.059858Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.059858Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:e2489496678c1ba07c6273a835dd29944aa4fb2ceb4054ba32ac68bb1598e925","observation_id":"3dbb7cab-ad52-45ee-922b-f9fd6034d599","resolution":{"observed_at":"2026-08-07T14:47:32.059858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:41.144777Z","title":"Let’s verify step by step,","venue":null,"work_id":"bf3f9977-b9bd-4c35-8ead-bf7decd6423c","year":null},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.165273Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:77ddd61d0185a4738d0be4c47c58ac2fea787d7c28a5ee47297ae90a0f39b752","observation_id":"6437156d-ee2c-4780-8d24-c4bb42bacb1e","resolution":{"observed_at":"2026-08-07T14:47:41.233452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:32.289866Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.289866Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:4c3bbc510286ac218e5456d0518b862dbe7225eb19e747a7126f46f8f6ec4779","observation_id":"42862b6b-2095-4c10-8f7d-e04f9d111cce","resolution":{"observed_at":"2026-08-07T14:47:32.289866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:32.393396Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.393396Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:d9147c9361b363ff01ed407a61809be9bbcea72cc2331f7059ea9447c6c368a8","observation_id":"905af32e-42a9-4563-90d0-474da0734f1c","resolution":{"observed_at":"2026-08-07T14:47:32.393396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:32.549847Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.549847Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:0c2980984927b8791d64edb6e80c3ed343bae09745a2a88f97bff59d445d6b16","observation_id":"88b247ec-8a59-4c65-b641-199438e0a1a9","resolution":{"observed_at":"2026-08-07T14:47:32.549847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:40.911160Z","title":"Mathvista: Evaluating mathemat- ical reasoning of foundation models in visual contexts, 2024","venue":null,"work_id":"4a7ca9c3-2798-4fa6-a742-35bfbe5f1635","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.631099Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:398bd92dbeb02ef5203f77335d56318765190775a7b5ddd5da2e7ffe5e92f93c","observation_id":"311bc923-e6d6-4673-bbc1-5047c0bbb309","resolution":{"observed_at":"2026-08-07T14:47:41.015915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:40.693769Z","title":"Reft: Reasoning with reinforced fine-tuning, 2024","venue":null,"work_id":"40163aeb-f260-4090-be52-efdf778d516a","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.788606Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:d1e5831cfa18f070bdfe6c24208cc15fdda1f0238a1cbf9ec451c56f0ebe28f4","observation_id":"f8aca2f8-2b87-461c-974f-a09d66061dda","resolution":{"observed_at":"2026-08-07T14:47:40.812974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:40.512822Z","title":"Exploring the limit of outcome reward for learning mathematical reasoning, 2025","venue":null,"work_id":"0cbaf9ca-a56c-4e53-b928-6cec53264aa1","year":2025},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.905189Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:f64c67080295f9e464a961c1775f630c0c79a7e3b91b30f4514d67eac2ba758e","observation_id":"b5034237-5478-4012-8de3-7ef2a51da934","resolution":{"observed_at":"2026-08-07T14:47:40.583463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:40.243438Z","title":"S1: Simple test-time scaling, 2025","venue":null,"work_id":"2924c2ec-c48f-4009-ae24-0aefa720671f","year":2025},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.014200Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:9a10864298b6fd62261ec09896e252af763da7af58105467f39c54e0290bc78b","observation_id":"0900553d-5280-4126-a7f5-36208960ef38","resolution":{"observed_at":"2026-08-07T14:47:40.407357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:40.039944Z","title":null,"venue":null,"work_id":"2b74b2cc-757b-4c3f-9568-4d0658a4958a","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.130338Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:00362944b22d2f34cf5b19d8786e72886c39e9cd3d7196c11f6fef1a3313511d","observation_id":"66ee2e16-c878-4135-a509-96ed5d231faa","resolution":{"observed_at":"2026-08-07T14:47:40.113828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:39.904191Z","title":"Multimath: Bridging visual and math- ematical reasoning for large language models, 2024","venue":null,"work_id":"8ac4486d-8abc-4cb0-88e8-6e6714869178","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.237895Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:960359f7bdaf93c7b0bbda3d3b42bc9b13786e660701878a5f1824df2a9b48b1","observation_id":"205eb7af-e202-46d3-96b9-9beddbaae91c","resolution":{"observed_at":"2026-08-07T14:47:39.964561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:39.769176Z","title":"Mutual reasoning makes smaller llms stronger problem-solvers, 2024","venue":null,"work_id":"8682df54-4650-4f0c-b0d3-351deeadf15a","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.377679Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:f4e678037eab09cf42726b80bb40d6be89719a76b17abcb1383c8cd69ec2e711","observation_id":"69389a61-be99-46ee-916d-8113c2bc7dba","resolution":{"observed_at":"2026-08-07T14:47:39.854576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:39.499866Z","title":"O1 replication journey: A strategic progress report – part 1, 2024","venue":null,"work_id":"9a2c851b-4962-4d11-9379-17e2274af1ed","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.485679Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:400bcee85fe5c94e7617c9fba550b4a26b5c1f56201bb7e974790059ca8d989b","observation_id":"ebd2c04a-d3f8-4f34-bb5e-9d5ed0df9b5c","resolution":{"observed_at":"2026-08-07T14:47:39.661379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:39.280395Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"177fef50-ca46-4000-aa2f-03407ce73305","year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.597371Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:605f4f327255e24e92eca953b25ce14d9ecae9b1af1f350b44f9a88fc3b207af","observation_id":"59959f09-fd48-4b1d-925e-70bd1fb2738c","resolution":{"observed_at":"2026-08-07T14:47:39.388599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T14:47:33.780681Z","title":"Deepseekmath: Pushing the limits of mathe- matical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.780681Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:8e0385e26408ff5bb472e879a5aa11e38a573e8e79677929b229d316bf1d4253","observation_id":"13fad878-7308-4af9-986b-8e6d541555d3","resolution":{"observed_at":"2026-08-07T14:47:33.780681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:38.988078Z","title":"Math- llava: Bootstrapping mathematical reasoning for multimodal large language models, 2024","venue":null,"work_id":"971a6559-b7b4-441f-bf25-57e2f17f4940","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.916385Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:ccb5be95dec303168658cd71191409a21ea3bcd00f0f6e94bd3c748312c697db","observation_id":"beedb142-aa54-4d4d-8b22-c9eebc44eb31","resolution":{"observed_at":"2026-08-07T14:47:39.171333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:38.761287Z","title":"Scaling llm test-time compute optimally can be more effec- tive than scaling model parameters, 2024","venue":null,"work_id":"b329ecd0-8b4d-4d1a-a685-a99237a97ee1","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.086124Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:0604c01ca417b6b46f0d858d1b022afa55ddc00eecd98e7bfb691fb0ee1f6e46","observation_id":"f6b91cd2-8da6-4a7f-a2f4-6cb215b22f90","resolution":{"observed_at":"2026-08-07T14:47:38.873933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T14:47:34.230841Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.230841Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:b51f8cd4e0bbd32b607dfb433544cd6b74d6742e9f800e6451cc2ba8a455b48b","observation_id":"1e699345-5325-494d-ba47-ecba532371d0","resolution":{"observed_at":"2026-08-07T14:47:34.230841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:38.456004Z","title":null,"venue":null,"work_id":"44da5b55-d476-4d5b-9566-e1e50047a5c7","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.330075Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:d3716e88ae278a03673a3ce873b9c579178a0f5216eef061c8473f3c86fbc182","observation_id":"6457b7f5-58db-4579-bdde-0639d5f18a72","resolution":{"observed_at":"2026-08-07T14:47:38.621626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:38.209936Z","title":"Slow perception: Let’s perceive geometric figures step-by-step,","venue":null,"work_id":"b8e2be0c-f85f-4ae7-be17-37460b7cf0b8","year":null},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.447530Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:2bdac4ba5fed392fffd8fb33369c20e4db84a845e07a22aaea5a156da6fa16e7","observation_id":"75b67f35-8a69-4758-ab29-1a920dd71080","resolution":{"observed_at":"2026-08-07T14:47:38.344081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:37.952801Z","title":"Gee, and Yixin Nie","venue":null,"work_id":"3e10010d-e864-42c2-b28f-3c2941594d32","year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.534458Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:2b4a502255151fe0363fca74503ce8e38db96000769bf9f4aa18d1902525b0ed","observation_id":"2cf9270d-7f2a-4bae-a1ae-aaf940c3196b","resolution":{"observed_at":"2026-08-07T14:47:38.072859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:37.727895Z","title":"Atomthink: A slow thinking framework for multi- modal mathematical reasoning, 2024","venue":null,"work_id":"fae7db56-dec7-44b3-a59b-ba009dd9b562","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.696748Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:3b99df01c6252788d6281a3b2e7c82bbb440cd77f9982ddffbfb24ac59e3a4f7","observation_id":"8ea95854-cd31-4c74-ba11-364496fbee7c","resolution":{"observed_at":"2026-08-07T14:47:37.825685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:37.495216Z","title":"Llava-o1: Let vision language models reason step- by-step, 2024","venue":null,"work_id":"56977758-3317-4554-b3e2-1f0c102e6b58","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.807611Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:57656958d6bac6c754d107bc1d4f78f966cdbf920dcb039f41e2ee0d57a1aa5d","observation_id":"3e140fd6-88b9-484c-bfb3-29cc11bfe3b0","resolution":{"observed_at":"2026-08-07T14:47:37.600994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:37.205665Z","title":"Mulberry: Em- powering mllm with o1-like reasoning and reflection via col- lective monte carlo tree search, 2024","venue":null,"work_id":"e9beefef-8487-4ec1-8a69-3a1ffb97d62b","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.981884Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:b61a68501aa288fb35511c398f05758e538f3b0b344a49bfe6fabafe80683621","observation_id":"f18cd552-9e7a-4032-bab2-c8f85fbe2254","resolution":{"observed_at":"2026-08-07T14:47:37.361926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-02T15:00:50.388422Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-07T14:47:35.106693Z","title":"Metamath: Bootstrap your own mathe- matical questions for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.106693Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:555c91df7d173665bed9030f73989effb81ccbed0df7ef12d98bcfdd3e5c5893","observation_id":"4abcf3b2-5b6b-4f51-b40b-b5d214c9dc2c","resolution":{"observed_at":"2026-08-07T14:47:35.106693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-07T14:47:35.253719Z","title":"Mm-vet: Evaluating large multimodal models for integrated capabilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.253719Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:698a78f16c4e7121423631ea68db626e4e780d3396f9d87cf822cbe23af57843","observation_id":"ec856a6f-535f-40ce-bfb6-0f840bf6e849","resolution":{"observed_at":"2026-08-07T14:47:35.253719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:36.950454Z","title":"Llama-berry: Pair- wise optimization for o1-like olympiad-level mathematical reasoning, 2024","venue":null,"work_id":"62bf599d-c7a2-476e-8594-c8e355110643","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.370481Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:5c58137c6e8ee46ef76931fe00d20fae40e0a3d2ad3a0942e6a12c421797c8d7","observation_id":"f7e4553a-2ff7-4b7a-ac97-ea4998f64c7e","resolution":{"observed_at":"2026-08-07T14:47:37.056126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:36.730779Z","title":"Euclid: Supercharging multimodal llms with synthetic high-fidelity visual descriptions, 2024","venue":null,"work_id":"6011789d-66a9-4e5c-a1dc-910731d2b642","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.466112Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:c6aa57324b40a8d79fa70603b1e9f0a5049e660f1a7bd055c1e2844a0efe91a6","observation_id":"394f68ed-fa5f-4064-afee-71b6e90151e0","resolution":{"observed_at":"2026-08-07T14:47:36.828643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:36.486260Z","title":"Mathverse: Does your multi-modal llm truly see the diagrams in visual math prob- lems?, 2024","venue":null,"work_id":"f0d98da2-56a4-4142-ad31-d5ede9557b1d","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.613884Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:7f412fe437bba17988c85fd60ac9c654db61072e333a6bc78910520ed9e917b5","observation_id":"4aa23182-35f4-4281-adc2-4ccc16aebf93","resolution":{"observed_at":"2026-08-07T14:47:36.590741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16198","last_updated":"2024-10-21T17:00:06Z","snapshot_observed_at":"2026-08-08T03:30:51.616377Z","submitted_at":"2024-10-21T17:00:06Z","title":"Improve Vision Language Model Chain-of-thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16198","snapshot_observed_at":"2026-08-07T14:47:35.769084Z","title":"Improve vision language model chain-of- thought reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.769084Z"},"links":{"cited_paper":"/paper/2410.16198","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:2db61b484e712250ff4f4039b357e612b1d83eca84263ab5f44ec95e04a32a2e","observation_id":"e9448574-25cb-4b7c-b5f6-af5423f213ad","resolution":{"observed_at":"2026-08-07T14:47:35.769084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:36.314086Z","title":"How far are we from intelligent visual deductive reasoning?, 2024","venue":null,"work_id":"d4ef2d9a-7a4a-4256-9993-1df90d5391ce","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.974557Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:f4c66ff953dc5a8d46766e80c5653afe2e503c36c3c89bf3625c2ee0333989f8","observation_id":"9d2b6d23-6b04-4fce-b952-447ad17d3f1a","resolution":{"observed_at":"2026-08-07T14:47:36.367751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T14:47:36.084003Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:36.084003Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:ee790da5a97956301d8c43d11799e18d0ec08f666549eaf86f7c313248e81a24","observation_id":"220a7715-c1b0-424b-8e53-c18b8e34f584","resolution":{"observed_at":"2026-08-07T14:47:36.084003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T14:41:48.124130Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 2 inbound Pith citation observations for arXiv:2505.17609."}