{"as_of":"2026-08-08T04:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:54dfbb83b3ee240191e1a2c7ceec83cee3d2d05c4a88dafdc6fd39983739b593","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T06:08:28.246141Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T18:46:20.417039Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T18:48:53.330917Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"cited_work":{"arxiv_id":"2506.06034","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06034","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4d8c4719-a510-473c-be63-67bc74376b1f","year":2025},"citing_paper":{"arxiv_id":"2605.15963","last_updated":"2026-05-15T13:55:05Z","snapshot_observed_at":"2026-07-06T23:27:11.118592Z","submitted_at":"2026-05-15T13:55:05Z","title":"PAGER: Bridging the Semantic-Execution Gap in Point-Precise Geometric GUI Control","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T18:46:20.417039Z"},"links":{"cited_paper":"/paper/2506.06034","citing_paper":"/paper/2605.15963"},"observation_digest":"sha256:7efd68ced0f12805c93a2d921f95db3f8f0387b996344027e4db0b88e2b39ee1","observation_id":"5d4f9b23-04e4-4cda-83df-d3f0e84c26d8","resolution":{"observed_at":"2026-05-20T18:48:53.332391Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.06034/citation-record","integrity":"/paper/2506.06034/integrity","json":"/paper/2506.06034/citation-record.json","paper":"/paper/2506.06034"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1905.13319","last_updated":"2019-05-30T21:28:12Z","snapshot_observed_at":"2026-07-06T07:56:54.143277Z","submitted_at":"2019-05-30T21:28:12Z","title":"MathQA: Towards Interpretable Math Word Problem Solving with Operation-Based Formalisms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13319","snapshot_observed_at":"2026-08-07T06:08:21.855106Z","title":"Mathqa: Towards interpretable math word problem solving with operation-based formalisms.arXiv preprint arXiv:1905.13319, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:21.855106Z"},"links":{"cited_paper":"/paper/1905.13319","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:7b300bf13f73948517d17cb555267b88162f3122c1b9846fab9462c1879db198","observation_id":"acb883b3-5c29-4aef-bbf7-34413ea631c2","resolution":{"observed_at":"2026-08-07T06:08:21.855106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:34.310698Z","title":"Claude Sonnet","venue":null,"work_id":"0cf8fbb5-e9d7-4376-88f4-3c604095e7fd","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:21.905044Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:0b71827b96759be7385aad5d4cdd7cd3de16af9ca0398e7340f67b0fe6c46629","observation_id":"3c532b0d-ebde-4dbd-9019-67174cb88e00","resolution":{"observed_at":"2026-08-07T06:08:34.362771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12433","last_updated":"2023-02-24T03:28:46Z","snapshot_observed_at":"2026-08-07T23:35:22.858805Z","submitted_at":"2023-02-24T03:28:46Z","title":"ProofNet: Autoformalizing and Formally Proving Undergraduate-Level Mathematics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12433","snapshot_observed_at":"2026-08-07T06:08:21.997740Z","title":"Proofnet: Autoformalizing and formally proving undergraduate-level mathematics.arXiv preprint arXiv:2302.12433, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:21.997740Z"},"links":{"cited_paper":"/paper/2302.12433","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:f4595a17a5e9ae7e6f036b2164c4577824ef8cd74a0eb1a1ea3961ec1b3b649c","observation_id":"167569e3-65a8-40a0-b5f9-7fca7b9d3718","resolution":{"observed_at":"2026-08-07T06:08:21.997740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10631","last_updated":"2024-03-15T19:14:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-16T17:54:07Z","title":"Llemma: An Open Language Model For Mathematics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10631","snapshot_observed_at":"2026-08-07T06:08:22.093809Z","title":"Llemma: An open language model for mathematics.arXiv preprint arXiv:2310.10631, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.093809Z"},"links":{"cited_paper":"/paper/2310.10631","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:5bc63fbeedb8d1b76b07730753afb04148d1db4672f87b745fb5f2fe502ce9f9","observation_id":"7d4958a9-4096-4eac-b70a-c377c00380c6","resolution":{"observed_at":"2026-08-07T06:08:22.093809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:34.143528Z","title":"Springer Science & Business Me- dia, 2013","venue":null,"work_id":"9f7890b3-4abd-4411-adf7-b5aa5eabb11e","year":2013},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.216322Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:996cb6b75fa8798c687b56e817d6b3402e43a1f7e3f9fd60f7c19461c28817fd","observation_id":"51611b4a-13b8-4d83-bfff-1fbe85b86676","resolution":{"observed_at":"2026-08-07T06:08:34.231119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:33.985194Z","title":"An augmented benchmark dataset for geometric question answering through dual parallel text encoding","venue":null,"work_id":"d2b7e8f4-b579-4f6e-babd-7449e79ef31c","year":2022},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.366269Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:6e8acb4522ca76a1a761c42cdb4b5450f2e3cade43a9bdcef83e59c73a48acb2","observation_id":"06fefbf5-c199-4210-801e-6c73f27cb789","resolution":{"observed_at":"2026-08-07T06:08:34.089762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02746","last_updated":"2022-12-06T04:37:51Z","snapshot_observed_at":"2026-08-06T05:59:54.593795Z","submitted_at":"2022-12-06T04:37:51Z","title":"UniGeo: Unifying Geometry Logical Reasoning via Reformulating Mathematical Expression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.02746","snapshot_observed_at":"2026-08-07T06:08:22.470480Z","title":"Unigeo: Unifying geometry logical reasoning via reformulating mathematical expression.arXiv preprint arXiv:2212.02746, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.470480Z"},"links":{"cited_paper":"/paper/2212.02746","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:4844362da4cd689c284674a5aa167b4e75c5863beb0e2139c41f09f0b065d119","observation_id":"1179a2cd-654d-4699-b767-6589a11cde83","resolution":{"observed_at":"2026-08-07T06:08:22.470480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-07T06:08:22.574013Z","title":"Towards reasoning era: A survey of long chain-of-thought for reasoning large language models.arXiv preprint arXiv:2503.09567, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.574013Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:497ea3881e57043ca25646218bd16e5c6106407566b27b6a78641833bfc64486","observation_id":"0702550d-4da1-4819-bed9-5efa66ede162","resolution":{"observed_at":"2026-08-07T06:08:22.574013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:33.639175Z","title":"MIT Press, 2013","venue":null,"work_id":"e1d50a30-5b33-4304-880d-3979af90f5fd","year":2013},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.670481Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:771a0f6a1538c1dee5d043e8dd9d747259985d763882375376bcaf5c87f7381f","observation_id":"70a54f9c-515b-4817-9044-6e1832e5a516","resolution":{"observed_at":"2026-08-07T06:08:33.843539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T06:08:22.834147Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.834147Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:268eccf9154f92f7511ff8611e7b0054ec152e0e4097c8be147755ac6ed50517","observation_id":"5570880d-b59e-43e4-ae83-25a7980259e4","resolution":{"observed_at":"2026-08-07T06:08:22.834147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:33.393735Z","title":"Compfiles","venue":null,"work_id":"5929b56a-4364-4244-85a8-07abdc67122a","year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.950530Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:b784dca8e41448a2c5f751cd3ab48173638c80483e98345ae767f0aa3e15e691","observation_id":"e22ca28c-fe33-42ba-842b-ff10eb2eef9c","resolution":{"observed_at":"2026-08-07T06:08:33.499806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:33.239531Z","title":"Start building with gemini 2.5 flash","venue":null,"work_id":"62d94576-65b3-448e-b270-0eb6c9eb1af6","year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.014503Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:a664a9830c3e6b935e92459357204092fc7c88228ae38d8da0606c066a3a1b82","observation_id":"75df8126-e94b-4bda-a1c8-59953f60c123","resolution":{"observed_at":"2026-08-07T06:08:33.307670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:33.003718Z","title":"Mathematical capabilities of chatgpt.Advances in neural information processing systems, 36:27699–27744,","venue":null,"work_id":"6e6a96be-a52a-4733-ba63-d1258f1f04bd","year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.173500Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:e47c3358da622ee678dca3b11b423d969601489a51af724dfe483a93dc9a5403","observation_id":"1664df8e-3d06-4dba-9890-c813c0175c08","resolution":{"observed_at":"2026-08-07T06:08:33.104964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T06:08:23.581488Z","title":"Measuring massive multitask language understanding.arXiv preprint arXiv:2009.03300, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.581488Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:a3b665e0d831881c960da846bfbd9d90c1164e48d66af1d8951198bd5fbea471","observation_id":"76cda449-1bc7-42e0-8076-fd4cf77adfcf","resolution":{"observed_at":"2026-08-07T06:08:23.581488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T06:08:23.697375Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.697375Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:7a381f53995290675919cd0b344f1f199a02bbf2ee39025202eb2efe6b792590","observation_id":"3e870678-2d33-4427-a766-40a00f7f57be","resolution":{"observed_at":"2026-08-07T06:08:23.697375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09403","last_updated":"2024-11-11T00:54:32Z","snapshot_observed_at":"2026-08-05T09:57:39.370124Z","submitted_at":"2024-06-13T17:59:31Z","title":"Visual Sketchpad: Sketching as a Visual Chain of Thought for Multimodal Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09403","snapshot_observed_at":"2026-08-07T06:08:23.824053Z","title":"Visual sketchpad: Sketching as a visual chain of thought for multimodal language models.arXiv preprint arXiv:2406.09403, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.824053Z"},"links":{"cited_paper":"/paper/2406.09403","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:0541aaa58bec7f646119710bf553858cf3d60689de719355f1697783b0dffae7","observation_id":"77bd8e6a-ba53-422d-8865-9b17c424115f","resolution":{"observed_at":"2026-08-07T06:08:23.824053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.12283","last_updated":"2023-02-20T16:10:20Z","snapshot_observed_at":"2026-08-07T23:31:55.245259Z","submitted_at":"2022-10-21T22:37:22Z","title":"Draft, Sketch, and Prove: Guiding Formal Theorem Provers with Informal Proofs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.12283","snapshot_observed_at":"2026-08-07T06:08:23.894970Z","title":"Draft, sketch, and prove: Guiding formal theorem provers with informal proofs.arXiv preprint arXiv:2210.12283, 2022","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.894970Z"},"links":{"cited_paper":"/paper/2210.12283","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:087e42a34c8bdb6ad3a9053a156f13519cbe01f24e135b30dea9181cf7faf7fa","observation_id":"0824c7d0-488f-4018-87c1-dc4aa55f425e","resolution":{"observed_at":"2026-08-07T06:08:23.894970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:32.578382Z","title":"Lisa: Language models of isabelle proofs","venue":null,"work_id":"928ba1b7-5aac-4d69-8b37-95125562f063","year":2021},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.998470Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:9a553461d91d801b9b00ea234698f7a5a75eaafaec628b0ab8b0d3e696d0fbe9","observation_id":"fa850464-a228-45b4-9e60-772ec49e8481","resolution":{"observed_at":"2026-08-07T06:08:32.660889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:32.329767Z","title":"Hypertree proof search for neural theorem proving.Advances in neural information processing systems, 35:26337– 26349, 2022","venue":null,"work_id":"2ffbaf9a-c5f1-4923-b0f2-23a72d4c7e25","year":2022},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.130906Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:0b09ced55f9d7d5d59a6b95a56811748eb1d03814ac24266f80b18a5ecc0413e","observation_id":"54a6364c-4c60-452d-9fc2-8d3704295318","resolution":{"observed_at":"2026-08-07T06:08:32.457411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-07T15:49:03.741523Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04921","snapshot_observed_at":"2026-08-07T06:08:24.242469Z","title":"Perception, reason, think, and plan: A survey on large multimodal reasoning models.arXiv preprint arXiv:2505.04921, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.242469Z"},"links":{"cited_paper":"/paper/2505.04921","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:3f2ef299203e395b3ebf62f55e12b956abd5518e91333b6a8351229bd2de345f","observation_id":"1330ca35-564b-4e96-b1b6-6053bf94d57a","resolution":{"observed_at":"2026-08-07T06:08:24.242469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07640","last_updated":"2025-04-19T13:53:05Z","snapshot_observed_at":"2026-07-06T20:34:48.850154Z","submitted_at":"2025-02-11T15:27:35Z","title":"Goedel-Prover: A Frontier Model for Open-Source Automated Theorem Proving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07640","snapshot_observed_at":"2026-08-07T06:08:24.408162Z","title":"Goedel-prover: A frontier model for open-source automated theorem proving.arXiv preprint arXiv:2502.07640, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.408162Z"},"links":{"cited_paper":"/paper/2502.07640","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:ea992032a0db6644d344f99fa8d40dad7b9fa42e00daf089d07361c39fdd5abc","observation_id":"654347db-a614-4318-a427-e98efc433bac","resolution":{"observed_at":"2026-08-07T06:08:24.408162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.04146","last_updated":"2017-10-23T16:45:03Z","snapshot_observed_at":"2026-08-02T16:52:38.363314Z","submitted_at":"2017-05-11T13:04:47Z","title":"Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.04146","snapshot_observed_at":"2026-08-07T06:08:24.478551Z","title":"Program induction by ratio- nale generation: Learning to solve and explain algebraic word problems.arXiv preprint arXiv:1705.04146, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.478551Z"},"links":{"cited_paper":"/paper/1705.04146","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:273ff5b1860ae1c62826599c2c76d3759b1d8efb15539f51cd776505f5ecbe2c","observation_id":"7feea3de-c201-430f-bc5e-3b4f8599f66f","resolution":{"observed_at":"2026-08-07T06:08:24.478551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04295","last_updated":"2023-12-05T08:38:01Z","snapshot_observed_at":"2026-08-07T23:35:18.737859Z","submitted_at":"2023-09-08T12:34:28Z","title":"FIMO: A Challenge Formal Dataset for Automated Theorem Proving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04295","snapshot_observed_at":"2026-08-07T06:08:24.562226Z","title":"Fimo: A challenge formal dataset for automated theorem proving, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.562226Z"},"links":{"cited_paper":"/paper/2309.04295","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:42dda8f705432d90e7f00b74819b7ce4a12128b44e61633e3c799a6d13febb78","observation_id":"fdba6ed3-a7f0-48d2-b337-eca28ea169e1","resolution":{"observed_at":"2026-08-07T06:08:24.562226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:32.012798Z","title":"Improved baselines with visual instruction tuning, 2023","venue":null,"work_id":"873e9a63-5abb-4a4f-8549-17ab05452946","year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.650929Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:53431f0ac330bbf5b9a3d025cd70dcd5cac1add6be587f5d46a3a50ba237bd0e","observation_id":"4ecda9a4-ecc5-4ac3-975b-12072c97a093","resolution":{"observed_at":"2026-08-07T06:08:32.154902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02834","last_updated":"2024-11-01T02:21:13Z","snapshot_observed_at":"2026-07-06T19:10:29.880696Z","submitted_at":"2024-09-04T16:00:21Z","title":"CMM-Math: A Chinese Multimodal Math Dataset To Evaluate and Enhance the Mathematics Reasoning of Large Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02834","snapshot_observed_at":"2026-08-07T06:08:24.733133Z","title":"Cmm-math: A chinese multimodal math dataset to evaluate and enhance the mathematics reasoning of large multimodal models.arXiv preprint arXiv:2409.02834, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.733133Z"},"links":{"cited_paper":"/paper/2409.02834","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:73613379f1a7d272973e6955f861ad11f1d1f246840f0b01b876bdbee84ca386","observation_id":"08f2d713-e59b-4ce1-88ec-09763e6149fe","resolution":{"observed_at":"2026-08-07T06:08:24.733133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04165","last_updated":"2021-07-20T23:22:27Z","snapshot_observed_at":"2026-08-06T13:29:31.050456Z","submitted_at":"2021-05-10T07:46:55Z","title":"Inter-GPS: Interpretable Geometry Problem Solving with Formal Language and Symbolic Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04165","snapshot_observed_at":"2026-08-07T06:08:24.805851Z","title":"Inter-gps: Interpretable geometry problem solving with formal language and symbolic reasoning.arXiv preprint arXiv:2105.04165, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.805851Z"},"links":{"cited_paper":"/paper/2105.04165","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:4c2a6261c21f647059cc3cff42de55aeb9302dc7e7fb6b0b893aaf48c1fde70b","observation_id":"a2bc0fef-0689-471b-9728-ded97078fcc0","resolution":{"observed_at":"2026-08-07T06:08:24.805851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-07T06:08:24.896278Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts.arXiv preprint arXiv:2310.02255, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.896278Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:40cf2e3c8cb197a74123ed822bbdd499f08f1842813628affd0ea04c5b817567","observation_id":"8fde812d-926a-46bb-8ab2-30f19f339af1","resolution":{"observed_at":"2026-08-07T06:08:24.896278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10244","last_updated":"2022-03-19T05:00:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-19T05:00:30Z","title":"ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10244","snapshot_observed_at":"2026-08-07T06:08:25.001892Z","title":"Chartqa: A benchmark for question answering about charts with visual and logical reasoning.arXiv preprint arXiv:2203.10244, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.001892Z"},"links":{"cited_paper":"/paper/2203.10244","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:a8976e41cc029a699e92db91135ad59cc4937ff5b1b732d5f52505cf02f06e0c","observation_id":"cf742dc9-84b6-44f5-94d2-768785c543df","resolution":{"observed_at":"2026-08-07T06:08:25.001892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17517","last_updated":"2023-03-08T16:47:46Z","snapshot_observed_at":"2026-08-04T16:15:25.064317Z","submitted_at":"2022-10-31T17:41:26Z","title":"Lila: A Unified Benchmark for Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17517","snapshot_observed_at":"2026-08-07T06:08:25.116856Z","title":"Lila: A unified benchmark for mathematical reasoning.arXiv preprint arXiv:2210.17517, 2022","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.116856Z"},"links":{"cited_paper":"/paper/2210.17517","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:722af05a28d3609f7ce214ad7d310cf77068e0eb4aba63560d4db767c1585c2b","observation_id":"c396e12a-dcb1-4eeb-affc-457d8cff22d4","resolution":{"observed_at":"2026-08-07T06:08:25.116856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:25.221848Z","title":"The lean 4 theorem prover and programming language","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.221848Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:b891bc7702301715e843f4a195a86f934c6a8643813c3aa225627ff8be67db29","observation_id":"af94ed3b-2234-40df-b93b-aa149fee2ba2","resolution":{"observed_at":"2026-08-07T06:08:25.221848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17216","last_updated":"2024-05-27T14:35:10Z","snapshot_observed_at":"2026-08-07T11:46:33.138682Z","submitted_at":"2024-05-27T14:35:10Z","title":"Autoformalizing Euclidean Geometry","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17216","snapshot_observed_at":"2026-08-07T06:08:25.341953Z","title":"Autoformalizing euclidean geometry.arXiv preprint arXiv:2405.17216, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.341953Z"},"links":{"cited_paper":"/paper/2405.17216","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:b8fd50366bbdaeb55a51ab73b597ad49e1ed0c69d49d08e66b90955e344881ea","observation_id":"d4a8acd1-bb00-4abc-a119-28f0c9f6ef44","resolution":{"observed_at":"2026-08-07T06:08:25.341953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:31.749735Z","title":"GPT-4.1.https://openai.com/index/gpt-4-1/, 2024","venue":null,"work_id":"7e0e1b74-9584-4e15-87d0-31b25d483954","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.405965Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:472363e6939ff37e67464e3d016fd8fed124d91af751a66fab5bf637eacb2fbb","observation_id":"895eebe7-1527-42c7-9204-608ea94e3d63","resolution":{"observed_at":"2026-08-07T06:08:31.885301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:31.527796Z","title":"Introducing o3 and o4-mini","venue":null,"work_id":"30c8d146-89ac-4f6c-9f24-18f836dda9e5","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.460899Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:770c040142ea984dc1c8e4757329c553f59f0a7efdd715d201d72c41717c0370","observation_id":"2ebd40f4-579d-43d8-8a08-c0584261b028","resolution":{"observed_at":"2026-08-07T06:08:31.653004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03393","last_updated":"2020-09-07T19:50:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T19:50:10Z","title":"Generative Language Modeling for Automated Theorem Proving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03393","snapshot_observed_at":"2026-08-07T06:08:25.530207Z","title":"Generative language modeling for automated theorem proving","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.530207Z"},"links":{"cited_paper":"/paper/2009.03393","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:2dbfbfb87d9621a94b01c2ff36ef15c691246a38d2fc4e4b3749eff2ad0cb132","observation_id":"95ab73d0-ed12-4361-90c3-1cd5ce07448d","resolution":{"observed_at":"2026-08-07T06:08:25.530207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:31.310619Z","title":"Artificial intelligence mathematical olympiad (aimo) prize, 2023","venue":null,"work_id":"42a3eaf3-d972-45dc-8a8b-d941ce027430","year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.727399Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:41f38760e5761c7e3c80002a1e65b0fde0665396f55ac7b896bf227715e405b3","observation_id":"88a9890a-34c1-4455-b04b-7add4ca06e26","resolution":{"observed_at":"2026-08-07T06:08:31.411389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:25.795135Z","title":"A survey of efficient reasoning for large reasoning models: Language, multimodality, and beyond.arXiv preprint arXiv:2503.21614, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.795135Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:73a670208d0a35267721c0c50d2b9a25af97345d4676d1bec2f4ec8733e5f0af","observation_id":"71412192-617b-4eba-a436-b2c54db3699b","resolution":{"observed_at":"2026-08-07T06:08:25.795135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21801","last_updated":"2025-07-18T08:20:23Z","snapshot_observed_at":"2026-08-02T11:46:58.603316Z","submitted_at":"2025-04-30T16:57:48Z","title":"DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21801","snapshot_observed_at":"2026-08-07T06:08:25.882735Z","title":"Deepseek-prover-v2: Advancing formal mathematical reasoning via reinforcement learning for subgoal decomposition.arXiv preprint arXiv:2504.21801, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.882735Z"},"links":{"cited_paper":"/paper/2504.21801","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:c8cc1c528fe64b798ea5e69f07405926f9c8b68c4d12ab5f980d808c5f405384","observation_id":"043df018-ce33-4d94-b359-2086772ec1a4","resolution":{"observed_at":"2026-08-07T06:08:25.882735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:31.074452Z","title":"Elsevier,","venue":null,"work_id":"4211f12a-1d89-4f6b-b798-2f907a7b329f","year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.957670Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:b409ae9d406de077543b3d76f83268eb226ab96df9a82353e344ef3bf1f5bc7f","observation_id":"59268741-d604-42b1-93f7-8fd56a470ae8","resolution":{"observed_at":"2026-08-07T06:08:31.187743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:30.706735Z","title":"Imo grand challenge.URL https://imo-grand-challenge","venue":null,"work_id":"862d92e8-5efc-409d-873f-76b820eb3167","year":2020},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.111225Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:07977ac54fc8e52934277647efcbaaf8b3929324fdebc22ce8ce991b185dc4b2","observation_id":"2a222a7c-ea52-456e-88b8-673346dc9dc7","resolution":{"observed_at":"2026-08-07T06:08:30.768042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:30.535843Z","title":"Solving geometry problems: Combining text and diagram interpretation","venue":null,"work_id":"7ca8c7b2-dffa-4811-8223-397e3c553a7d","year":2015},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.188441Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:5233c1752fb79865b8edfd5018934d32f10c19d40ada5370f9124166d3887da4","observation_id":"b11cb3a4-a417-42f0-8723-1fb1c0e4722c","resolution":{"observed_at":"2026-08-07T06:08:30.633467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T06:08:26.270766Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.270766Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:c2304ba8d00dc867ff74bbea3c21d69bb0e68f9975c5565be560526ce2d3f906","observation_id":"0c23ffa2-fbcb-4e59-894f-f65eea910526","resolution":{"observed_at":"2026-08-07T06:08:26.270766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T06:08:26.344518Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models.arXiv preprint arXiv:2406.17294, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.344518Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:81c41cbfe0725355bc99c081fd898699b469a57d602657ba1572967a61d5005e","observation_id":"2bfd9f50-6f4c-412d-a024-af64874f16a4","resolution":{"observed_at":"2026-08-07T06:08:26.344518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:30.400783Z","title":"What does clip know about a red circle? visual prompt engineering for vlms","venue":null,"work_id":"3db3921a-b168-4bc5-8725-e24306f5c1d6","year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.412194Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:34be5ea4a5d91717fa7e40b900d6222d9979031d7510da1ca33c89c0f854d328","observation_id":"f79ce605-4d23-4551-8430-bcc1d18c50c0","resolution":{"observed_at":"2026-08-07T06:08:30.455017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:26.482320Z","title":"Qwen2.5-vl, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.482320Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:1b855d3047015ede775ff2b59c24eb213e7911e0c720b01a3748a59938195dc6","observation_id":"d2c77063-030d-4d18-b78f-a08451c9678e","resolution":{"observed_at":"2026-08-07T06:08:26.482320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04353","last_updated":"2024-08-08T04:15:31Z","snapshot_observed_at":"2026-08-07T23:31:29.854288Z","submitted_at":"2023-10-06T16:21:22Z","title":"An In-Context Learning Agent for Formal Theorem-Proving","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04353","snapshot_observed_at":"2026-08-07T06:08:26.563979Z","title":"An in-context learning agent for formal theorem-proving.arXiv preprint arXiv:2310.04353, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.563979Z"},"links":{"cited_paper":"/paper/2310.04353","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:efb5e205e3255e46dd5a1403d36f340e34a42b03aa6d5bd7af32a3f7b55dc1c3","observation_id":"b874b35f-e245-4960-842f-c504424062fe","resolution":{"observed_at":"2026-08-07T06:08:26.563979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:30.201224Z","title":"Solving olympiad geometry without human demonstrations.Nature, 625(7995):476–482, 2024","venue":null,"work_id":"8de21682-8f3b-4848-a727-a7773f9f6461","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.633889Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:df89d4cabf7b66fa5cd581c13763a418c7f371766d5e05e6474b0989b8868f74","observation_id":"03dc5019-849f-4099-864a-cab55bc96b42","resolution":{"observed_at":"2026-08-07T06:08:30.288689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11214","last_updated":"2024-11-03T17:14:37Z","snapshot_observed_at":"2026-08-05T18:50:54.811289Z","submitted_at":"2024-07-15T19:57:15Z","title":"PutnamBench: Evaluating Neural Theorem-Provers on the Putnam Mathematical Competition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11214","snapshot_observed_at":"2026-08-07T06:08:26.694429Z","title":"Putnambench: Evaluating neural theorem-provers on the putnam mathematical competition.arXiv preprint arXiv:2407.11214, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.694429Z"},"links":{"cited_paper":"/paper/2407.11214","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:0356fa61b17a6aeaad6d51ae320c4d5845b6e398543d249edc827e1d4734f5dc","observation_id":"d0cab9c9-272d-4b39-9ffc-587b1563e01b","resolution":{"observed_at":"2026-08-07T06:08:26.694429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14414","last_updated":"2024-05-23T10:35:08Z","snapshot_observed_at":"2026-07-06T18:18:30.066741Z","submitted_at":"2024-05-23T10:35:08Z","title":"Proving Theorems Recursively","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14414","snapshot_observed_at":"2026-08-07T06:08:26.801891Z","title":"Proving theorems recursively.arXiv preprint arXiv:2405.14414, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.801891Z"},"links":{"cited_paper":"/paper/2405.14414","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:b8c6dfe308c77134658a469106107fd52e8cdb1752b6cdf99b0c17d0fb3dc69f","observation_id":"fcd33a01-a62e-4fd9-9be8-14d4b9b53fac","resolution":{"observed_at":"2026-08-07T06:08:26.801891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:30.042913Z","title":"Measuring multimodal mathematical reasoning with math- vision dataset.Advances in Neural Information Processing Systems, 37:95095–95169,","venue":null,"work_id":"ae5099f1-6738-4587-91a3-892c2c45f130","year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.868017Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:3e4eeff09b27db763067f3321aeb0062959ce50bef3c938667d691f0fb0ce8dd","observation_id":"15779d59-3c4f-42c2-9cd0-896e99a74108","resolution":{"observed_at":"2026-08-07T06:08:30.128153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20808","last_updated":"2025-08-01T13:54:16Z","snapshot_observed_at":"2026-08-07T17:40:37.569464Z","submitted_at":"2025-02-28T07:50:36Z","title":"MV-MATH: Evaluating Multimodal Math Reasoning in Multi-Visual Contexts","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20808","snapshot_observed_at":"2026-08-07T06:08:27.028489Z","title":"Mv- math: Evaluating multimodal math reasoning in multi-visual contexts.arXiv preprint arXiv:2502.20808, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.028489Z"},"links":{"cited_paper":"/paper/2502.20808","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:177c0b116473cd54a96abe0a74ab837f1cb9e87d26787c55eb16ddc2a7c1088f","observation_id":"bc114644-a2fc-4d2d-afaa-9d4a5207644e","resolution":{"observed_at":"2026-08-07T06:08:27.028489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03203","last_updated":"2024-10-04T03:06:26Z","snapshot_observed_at":"2026-08-06T12:33:36.607923Z","submitted_at":"2024-07-03T15:36:18Z","title":"TheoremLlama: Transforming General-Purpose LLMs into Lean4 Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03203","snapshot_observed_at":"2026-08-07T06:08:27.144650Z","title":"Theoremllama: Transforming general-purpose llms into lean4 experts.arXiv preprint arXiv:2407.03203, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.144650Z"},"links":{"cited_paper":"/paper/2407.03203","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:ebd12af18ea168ef7f842413f84a9b2c15bb7e8cbfc496b86d92dd7566483d3c","observation_id":"0a9a7827-cbb4-4c0c-87e6-d355e50d3b1a","resolution":{"observed_at":"2026-08-07T06:08:27.144650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.23703","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:28.517927Z","title":"Fung, and Tong Zhang","venue":null,"work_id":"e296cacc-5149-44ff-b8d5-087e55a8191b","year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.227184Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:bd0db1a48fe0c322b120dbe7bcbd8b27e3b54a56d443f3cbb25e426be5561e18","observation_id":"7f4882c0-5c08-4ebb-a227-a3678941626b","resolution":{"observed_at":"2026-08-07T06:08:28.602806Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:29.699717Z","title":"The isabelle framework","venue":null,"work_id":"e44c34be-33ca-44f1-94c0-ca4d4be643c5","year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.313857Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:dac11b3823817b004fbf865d99e6b6b849b4097e2db86dd5c1eac22cc70ba767","observation_id":"ff394c0c-ea07-48e3-86c5-7240c56add5f","resolution":{"observed_at":"2026-08-07T06:08:29.763857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:27.815011Z","title":"Leandojo: Theorem proving with retrieval-augmented language models.Advances in Neural Information Processing Systems, 36:21573–21612, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.815011Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:7828276b94e31c8fe3c9f3825227fac18e1c364cb3f913364f0f49fc3a42ab68","observation_id":"cdeb2da0-f271-4d9b-9b11-2df79c5e0364","resolution":{"observed_at":"2026-08-07T06:08:27.815011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03847","last_updated":"2025-06-18T16:07:47Z","snapshot_observed_at":"2026-08-07T23:35:20.471377Z","submitted_at":"2024-06-06T08:25:43Z","title":"Lean Workbook: A large-scale Lean problem set formalized from natural language math problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03847","snapshot_observed_at":"2026-08-07T06:08:27.915796Z","title":"Lean workbook: A large-scale lean problem set formalized from natural language math problems.arXiv preprint arXiv:2406.03847, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.915796Z"},"links":{"cited_paper":"/paper/2406.03847","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:fabfeb584751d8034407afee493a56a5e388d6ef23aa0c1b77a32398c42b53ec","observation_id":"094cce33-edbc-4774-b7e6-68681c8359da","resolution":{"observed_at":"2026-08-07T06:08:27.915796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:29.480909Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for expert agi","venue":null,"work_id":"b2bc88f6-d15d-4cee-8ce5-39989cb3f790","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:28.013211Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:421951706e873f6f11baa0d7ed11238fcaae4c00320b2522a6f9250bb717e1b9","observation_id":"0ae23a6e-440f-4b82-a9ca-6af557a91687","resolution":{"observed_at":"2026-08-07T06:08:29.601101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:29.275877Z","title":"Mathverse: Does your multi-modal llm truly see the diagrams in visual math problems? InEuropean Conference on Computer Vision, pages 169–186","venue":null,"work_id":"6e07a4fe-dc31-45e5-9d37-d1632318e913","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:28.099080Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:e2998ce67ab59747bf4faaf276eac20bff3cd7601140d6fe8bf441bc60c8514a","observation_id":"6bbee102-0225-4836-9239-3276f462bdd6","resolution":{"observed_at":"2026-08-07T06:08:29.380731Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00110","last_updated":"2022-02-28T06:03:23Z","snapshot_observed_at":"2026-08-06T09:47:40.209642Z","submitted_at":"2021-08-31T23:21:12Z","title":"MiniF2F: a cross-system benchmark for formal Olympiad-level mathematics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.00110","snapshot_observed_at":"2026-08-07T06:08:28.160898Z","title":"Limitations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:28.160898Z"},"links":{"cited_paper":"/paper/2109.00110","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:a7342f3e5e4880c00f71591711d350945e08370752a270b0816bd60586b1119b","observation_id":"7d941f0c-0830-4b49-8308-69e3209a41f7","resolution":{"observed_at":"2026-08-07T06:08:28.160898Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08152","last_updated":"2024-08-15T13:40:03Z","snapshot_observed_at":"2026-07-06T19:01:06.124684Z","submitted_at":"2024-08-15T13:40:03Z","title":"DeepSeek-Prover-V1.5: Harnessing Proof Assistant Feedback for Reinforcement Learning and Monte-Carlo Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08152","snapshot_observed_at":"2026-08-07T06:08:27.508982Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.508982Z"},"links":{"cited_paper":"/paper/2408.08152","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:969dbe70462d62f6f787a74e8a14912b6cc5d60047281188169371f0ec81c7ea","observation_id":"31f0da6c-8af6-4be9-8cf0-71392c1708dc","resolution":{"observed_at":"2026-08-07T06:08:27.508982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-04T03:29:49.409446Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-07T06:08:27.708050Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.708050Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:1ff2a9b9eba834ec9697595b84dbbc856912e6f4c24805721115eb073f6af273","observation_id":"aa45ff06-b898-4bc1-b725-c9796301a215","resolution":{"observed_at":"2026-08-07T06:08:27.708050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:29.137152Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":"9ccdd312-78c0-4953-aa82-0609531df947","year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:28.246141Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:6678be4c8b6aacb0f303a856c46fae743f05cd9a7ea852e9918f9f7001a0127e","observation_id":"e5580767-efeb-4fd3-b020-f941661aaa9b","resolution":{"observed_at":"2026-08-07T06:08:29.190739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:30.848889Z","title":null,"venue":null,"work_id":"ecf7a400-1e43-455f-8c11-e769c79b40c0","year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.033854Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:b583c23152cff74bc5c18e7ed0fdc20dcd05b37573b2e3fa6d557bc2beeb9673","observation_id":"092f1825-15f8-44eb-884c-dda23176ad6a","resolution":{"observed_at":"2026-08-07T06:08:30.971403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:27.379237Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.379237Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:a2b5298f2c31eade10a4f81ad7e948fb3dcfea65238f1704be45ccde5241bf9b","observation_id":"34ed8203-6c5e-46ce-809e-84c419f43418","resolution":{"observed_at":"2026-08-07T06:08:27.379237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.01344","last_updated":"2022-02-03T00:17:00Z","snapshot_observed_at":"2026-08-04T20:41:41.817730Z","submitted_at":"2022-02-03T00:17:00Z","title":"Formal Mathematics Statement Curriculum Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.01344","snapshot_observed_at":"2026-08-07T06:08:25.636471Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.636471Z"},"links":{"cited_paper":"/paper/2202.01344","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:5b28f186e694f7236695feca752b04f1300efdcfff8854f6c902679f0de77737","observation_id":"d582042d-f4dd-4256-aa62-48b20b6fda73","resolution":{"observed_at":"2026-08-07T06:08:25.636471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:32.796939Z","title":null,"venue":null,"work_id":"eec85ec5-aa44-4fbf-8a58-347c9749da41","year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.249411Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:0c2078967e69e867ac5263beca1108c36722ffc7920b89c2452634054cfa4ede","observation_id":"931d50d9-794f-491f-a820-75208c7e1060","resolution":{"observed_at":"2026-08-07T06:08:32.898395Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:29.854272Z","title":null,"venue":null,"work_id":"7f3338f3-41f8-4f63-80d8-f11957117058","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.951158Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:4e518de62ae22b09b4e24393834b0a20562479b1ff068ec3e1119b9810b16810","observation_id":"71a7e03a-04b1-436d-b31f-50a16ec99525","resolution":{"observed_at":"2026-08-07T06:08:29.941786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:23.445192Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.445192Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:72a4376efb9409b0300df28cec1fef95980dcda1933edbb28e81fe5fa785d6b4","observation_id":"c1aa5b9c-eddd-4e06-b4cc-64f5e96b9d71","resolution":{"observed_at":"2026-08-07T06:08:23.445192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T23:32:23.352137Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 1 inbound Pith citation observation for arXiv:2506.06034."}