{"as_of":"2026-08-08T12:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5fbe8d09ceda43e606f9aa89ad708095ade134ab671513b9493e30efb50e3ae0","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:23:10.133741Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:26:42.768728Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T03:17:12.485198Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":"2505.19126","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19126","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"X., Sha, J., Wang, S., and Wen, J.-R","venue":null,"work_id":"f4b695d1-bd8c-436e-be6b-39d842709f0c","year":2025},"citing_paper":{"arxiv_id":"2604.09557","last_updated":"2026-05-28T14:40:40Z","snapshot_observed_at":"2026-08-03T16:37:32.743096Z","submitted_at":"2026-02-10T16:19:56Z","title":"SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-16T03:13:37.202362Z"},"links":{"cited_paper":"/paper/2505.19126","citing_paper":"/paper/2604.09557"},"observation_digest":"sha256:9cc5eccffaf4b5b98cd31926e8eaefb22299c87e9e85d670bd8f2d761b10e40d","observation_id":"fee38c7d-2114-436a-8153-3ca423a47e4c","resolution":{"observed_at":"2026-05-16T03:17:12.489033Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19126","snapshot_observed_at":"2026-08-03T02:40:56.699922Z","title":"X., Sha, J., Wang, S., and Wen, J.-R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.09557","last_updated":"2026-05-28T14:40:40Z","snapshot_observed_at":"2026-08-03T16:37:32.743096Z","submitted_at":"2026-02-10T16:19:56Z","title":"SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-03T02:40:56.699922Z"},"links":{"cited_paper":"/paper/2505.19126","citing_paper":"/paper/2604.09557"},"observation_digest":"sha256:f48a981427a2603e29a2702e4ad5f1b00ac1d1578d01fee640425043aaef161c","observation_id":"b644681d-94d5-4bbd-8a3d-f67a22039223","resolution":{"observed_at":"2026-08-03T02:40:56.699922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19126","snapshot_observed_at":"2026-07-12T05:47:14.970921Z","title":"Mmath: A multilingual benchmark for mathematical reasoning.arXiv preprint arXiv:2505.19126, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02966","last_updated":"2026-07-09T05:23:35Z","snapshot_observed_at":"2026-08-07T19:24:22.261816Z","submitted_at":"2026-07-03T05:17:48Z","title":"Distill Where the Student Goes: Teacher-Regularized RL for English-Evidence Cross-Lingual RAG","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-12T05:47:14.970921Z"},"links":{"cited_paper":"/paper/2505.19126","citing_paper":"/paper/2607.02966"},"observation_digest":"sha256:0559b2156b4cd7ddf3140636f162dee72869ac2722e5eae8dc651b889acb3510","observation_id":"a69d9326-96ba-4963-b369-ef162affe31f","resolution":{"observed_at":"2026-07-12T05:47:14.970921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19126","snapshot_observed_at":"2026-08-08T00:26:42.768728Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04160","last_updated":"2026-08-04T19:18:41Z","snapshot_observed_at":"2026-08-08T12:11:37.689704Z","submitted_at":"2026-08-04T19:18:41Z","title":"Mind the Cap: Output-Budget Regimes Change the Measured Multilingual Reasoning Gap","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T00:26:42.768728Z"},"links":{"cited_paper":"/paper/2505.19126","citing_paper":"/paper/2608.04160"},"observation_digest":"sha256:eeb1c0688a3428831f00320e07ca380904d3baabff104ed866f238f3975bf503","observation_id":"81fbb081-c0dc-4e48-8e24-4b7ab22f42f4","resolution":{"observed_at":"2026-08-08T00:26:42.768728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19126/citation-record","integrity":"/paper/2505.19126/integrity","json":"/paper/2505.19126/citation-record.json","paper":"/paper/2505.19126"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:07.223255Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.223255Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:db4850c62375090b143aadb1acb0562a5477c86b7f7cdd4518d22e5437699c53","observation_id":"faa506d2-aa2b-4a3e-8526-74981245ec4b","resolution":{"observed_at":"2026-08-07T14:23:07.223255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:07.319369Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.319369Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:a7476bc4754cf206ab152059822453cc153220195cbb81064856b46ee7aaeaad","observation_id":"f9bb1444-3c18-4c89-9343-e84620db43b0","resolution":{"observed_at":"2026-08-07T14:23:07.319369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:23:07.419306Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.419306Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:574d6e7720cd061cff8ee69366155549a575486c753d58330a121124320ba287","observation_id":"d42a1fb3-7aa2-4e28-903a-417debff2521","resolution":{"observed_at":"2026-08-07T14:23:07.419306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-acl.608","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:10.258421Z","title":null,"venue":null,"work_id":"1246ef8e-f767-4911-aabc-a304e69159d6","year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.582344Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:c7f87ce92b00ebc39148f22a2d80ef7ecdb4a621b2b666be22686090df7780d8","observation_id":"610e64e9-88e7-472c-89b2-b6ff41872fb5","resolution":{"observed_at":"2026-08-07T14:23:10.371093Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20246","last_updated":"2024-10-16T04:26:04Z","snapshot_observed_at":"2026-07-06T16:40:59.229510Z","submitted_at":"2023-10-31T08:09:20Z","title":"Breaking Language Barriers in Multilingual Mathematical Reasoning: Insights and Observations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20246","snapshot_observed_at":"2026-08-07T14:23:07.637228Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.637228Z"},"links":{"cited_paper":"/paper/2310.20246","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:e879dd2cf058d8c78d4747d0986c5ef46f212609937249ac6c3240f30fa8b83d","observation_id":"29eec08c-553b-4970-a66f-7eb8d63379be","resolution":{"observed_at":"2026-08-07T14:23:07.637228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T14:23:07.711092Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.711092Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:575d9f10c7bab36bc7387825808783f7072cbecb856ce5135c68e744883ed2ee","observation_id":"1c99119c-9b7d-4720-a7bf-b4eefff3e969","resolution":{"observed_at":"2026-08-07T14:23:07.711092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04672","last_updated":"2022-08-25T17:10:53Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T07:33:36Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.04672","snapshot_observed_at":"2026-08-07T14:23:07.790787Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.790787Z"},"links":{"cited_paper":"/paper/2207.04672","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:f1fdf1e6663b1540df9f71fe79473b8af2a60fe40caac5405b0ab272ffa3659e","observation_id":"0d1651ab-a443-4e6d-92a5-b07ca33bdfa7","resolution":{"observed_at":"2026-08-07T14:23:07.790787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:07.850381Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.850381Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:f2d01f8dbbf39142e5f2625108042cc4b67fde179edd10181b580ea66f0f299b","observation_id":"e2c51466-acd2-42fd-92de-0d7ff1590297","resolution":{"observed_at":"2026-08-07T14:23:07.850381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-07-06T16:25:25.534843Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-07T14:23:07.912353Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.912353Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:f0e149feea6a4245faa312dfcdef9be54e237f77ab194642327bfbf70a0b577e","observation_id":"beb2dcd8-ce09-4a45-ac89-9df398fc6e18","resolution":{"observed_at":"2026-08-07T14:23:07.912353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04519","last_updated":"2025-01-08T14:12:57Z","snapshot_observed_at":"2026-08-04T20:57:22.329262Z","submitted_at":"2025-01-08T14:12:57Z","title":"rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04519","snapshot_observed_at":"2026-08-07T14:23:07.990118Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.990118Z"},"links":{"cited_paper":"/paper/2501.04519","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:387255817cff9e140a45581b376d16af089695a7ec1cd4f6c708bde64d1489d8","observation_id":"55471775-4c12-4441-a108-254b5ab1853e","resolution":{"observed_at":"2026-08-07T14:23:07.990118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:23:08.053174Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.053174Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:e2d3891a81f79801b93f96b35560de6323e2ddb978d77c7e78b0c2fbad969954","observation_id":"32c5d370-a92a-4b7b-8c59-bfcdd142467e","resolution":{"observed_at":"2026-08-07T14:23:08.053174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:08.111443Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.111443Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:2520978310380a8826fee66b5a517e672fc373c2a99723382e5a121ef7ffb0ef","observation_id":"1e227d06-36dc-4bc5-a09b-38fc76ba5451","resolution":{"observed_at":"2026-08-07T14:23:08.111443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07004","last_updated":"2023-10-22T13:43:27Z","snapshot_observed_at":"2026-08-08T01:26:21.842000Z","submitted_at":"2023-05-11T17:44:17Z","title":"Not All Languages Are Created Equal in LLMs: Improving Multilingual Capability by Cross-Lingual-Thought Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07004","snapshot_observed_at":"2026-08-07T14:23:08.157526Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.157526Z"},"links":{"cited_paper":"/paper/2305.07004","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:1d5f14077ebdb706aabb09092f75c92e5a8cedcba6cef73ab266578cfbbae599","observation_id":"b37b26e2-b67f-4c2c-87da-1f79102a7642","resolution":{"observed_at":"2026-08-07T14:23:08.157526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T14:23:08.217262Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.217262Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:f0e7603dc4c8f7febdc193c8f249b7395a3a8f26e306aac4b75c9a1c888a42cf","observation_id":"db4b573f-4d08-4261-88db-8dadc65bd037","resolution":{"observed_at":"2026-08-07T14:23:08.217262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.01759","last_updated":"2016-08-09T17:38:43Z","snapshot_observed_at":"2026-07-06T05:02:39.487370Z","submitted_at":"2016-07-06T19:40:15Z","title":"Bag of Tricks for Efficient Text Classification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.01759","snapshot_observed_at":"2026-08-07T14:23:08.308482Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.308482Z"},"links":{"cited_paper":"/paper/1607.01759","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:9d08f0df5bb1e52bc6dbf1dbca62866538bd7ec855b8c005f906ed255754533f","observation_id":"6b2c6f7b-0ab2-4a10-b9f1-4f17005cc1ad","resolution":{"observed_at":"2026-08-07T14:23:08.308482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:08.368476Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.368476Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:354abc67160bd6c3d6a862b20d23e34c11f1daca916ee1c44188034d07b8ae15","observation_id":"d0bc264c-1ac5-47e7-bd6b-1968c47dea47","resolution":{"observed_at":"2026-08-07T14:23:08.368476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10258","last_updated":"2025-04-21T12:52:49Z","snapshot_observed_at":"2026-07-06T17:45:15.311629Z","submitted_at":"2024-03-15T12:47:39Z","title":"Is Translation All You Need? A Study on Solving Multilingual Tasks with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10258","snapshot_observed_at":"2026-08-07T14:23:08.422758Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.422758Z"},"links":{"cited_paper":"/paper/2403.10258","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:bc1424c52913e4126757582eb7d8ef502ff060dfcf93b595bf845f6025f06df0","observation_id":"1eb7bdee-0e00-438f-a4de-52dcb9460108","resolution":{"observed_at":"2026-08-07T14:23:08.422758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09858","last_updated":"2025-04-14T04:08:16Z","snapshot_observed_at":"2026-08-08T01:06:59.135762Z","submitted_at":"2025-04-14T04:08:16Z","title":"Reasoning Models Can Be Effective Without Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09858","snapshot_observed_at":"2026-08-07T14:23:08.495156Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.495156Z"},"links":{"cited_paper":"/paper/2504.09858","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:185ddc1c7b1b7502ba30880a1dc1bfa54e3479e668737972e7215cf70ae79657","observation_id":"589b9465-e882-4848-9dc0-09c161c1b77e","resolution":{"observed_at":"2026-08-07T14:23:08.495156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T14:23:08.556309Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.556309Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:696a2a6fa07f82804b8c90a1322b5c73bba431e647ee5d41f843eec4b048c44d","observation_id":"efa4c8ee-95e1-452f-a650-3558f40e8ed2","resolution":{"observed_at":"2026-08-07T14:23:08.556309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:11.351259Z","title":null,"venue":null,"work_id":"07873b39-290c-47cc-b0a2-718ca19158c4","year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.617520Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:54e08eb09637653f196398666d968ed771b7247be4c453f4569214f2a46e2ede","observation_id":"794ae10f-fa8d-4bd6-9a50-2050619c9fad","resolution":{"observed_at":"2026-08-07T14:23:11.459453Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06195","last_updated":"2024-08-12T14:42:13Z","snapshot_observed_at":"2026-07-31T21:52:59.633187Z","submitted_at":"2024-08-12T14:42:13Z","title":"Mutual Reasoning Makes Smaller LLMs Stronger Problem-Solvers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06195","snapshot_observed_at":"2026-08-07T14:23:08.712771Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.712771Z"},"links":{"cited_paper":"/paper/2408.06195","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:b25d0f7f0cfa1c5cd5248229588c0b09f9098656f15f01f6fab540caa6ce48d5","observation_id":"fa573d68-e3c0-47c5-adad-55b701f0db32","resolution":{"observed_at":"2026-08-07T14:23:08.712771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03057","last_updated":"2022-10-06T17:03:34Z","snapshot_observed_at":"2026-07-06T14:00:37.875054Z","submitted_at":"2022-10-06T17:03:34Z","title":"Language Models are Multilingual Chain-of-Thought Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03057","snapshot_observed_at":"2026-08-07T14:23:08.841421Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.841421Z"},"links":{"cited_paper":"/paper/2210.03057","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:1c2a52df71bd99ebd40d218ec0514ea198050c98037414a4e746467560acca40","observation_id":"c1fe0051-f845-40d3-9347-097c4de6651e","resolution":{"observed_at":"2026-08-07T14:23:08.841421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T14:23:08.923407Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.923407Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:295fbb52a8fa5850889263fc7d24983c76ab6f5ff64bb610e7cb1c4dae2771b0","observation_id":"d4fcd452-97e8-4fc3-b96d-ee2e1016a693","resolution":{"observed_at":"2026-08-07T14:23:08.923407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17407","last_updated":"2025-08-01T10:09:29Z","snapshot_observed_at":"2026-08-07T17:52:23.456305Z","submitted_at":"2025-02-24T18:36:15Z","title":"Linguistic Generalizability of Test-Time Scaling in Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17407","snapshot_observed_at":"2026-08-07T14:23:09.002273Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.002273Z"},"links":{"cited_paper":"/paper/2502.17407","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:02f9ddeb5066595e4d6346acd52c367c15cf8d022d0867eb8af9046b06a1601b","observation_id":"ebac370d-ca9a-474f-8cf2-bfda196efe5f","resolution":{"observed_at":"2026-08-07T14:23:09.002273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:09.117873Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.117873Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:22d0eabe7e3c6718f454c782accc5980a1351ef8013e8eb97b1ce61af11bb19d","observation_id":"191f0673-c489-48a0-8f6c-9d1952029b8e","resolution":{"observed_at":"2026-08-07T14:23:09.117873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:09.205941Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.205941Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:87d1fdc47c91d81d1b0f2e1c04e68eed466a7034786efdc29a9f9a222e6a75d2","observation_id":"685c80a3-b760-4492-bde7-4d7997b0229e","resolution":{"observed_at":"2026-08-07T14:23:09.205941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:09.298148Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.298148Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:61f5e4f9c022c44d6cb498483e3cae57a8c5df00b1b83c60df923232eb5ada56","observation_id":"ec258b61-05ac-477c-8d8d-1486ee25ea6f","resolution":{"observed_at":"2026-08-07T14:23:09.298148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10460","last_updated":"2025-05-28T12:32:29Z","snapshot_observed_at":"2026-08-08T01:11:14.602172Z","submitted_at":"2025-03-13T15:29:22Z","title":"Light-R1: Curriculum SFT, DPO and RL for Long COT from Scratch and Beyond","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10460","snapshot_observed_at":"2026-08-07T14:23:09.386204Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.386204Z"},"links":{"cited_paper":"/paper/2503.10460","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:2ab5c066d0fbfb910cc70b21b14192656e2c3a4a627108cb9676893d79da5d9f","observation_id":"d83f6548-a7f5-4fd5-aba7-4754a97c478f","resolution":{"observed_at":"2026-08-07T14:23:09.386204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24370","last_updated":"2025-05-21T17:51:27Z","snapshot_observed_at":"2026-08-07T16:20:08.878901Z","submitted_at":"2025-03-31T17:50:13Z","title":"Effectively Controlling Reasoning Models through Thinking Intervention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24370","snapshot_observed_at":"2026-08-07T14:23:09.580989Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.580989Z"},"links":{"cited_paper":"/paper/2503.24370","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:5f30a5f151f790139df945699f458c103001e0bcc74d9aecae03d4efd1dce4aa","observation_id":"d237930a-78fb-4b51-bb5d-f42005eae2c3","resolution":{"observed_at":"2026-08-07T14:23:09.580989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03789","last_updated":"2023-12-06T12:03:27Z","snapshot_observed_at":"2026-07-06T16:57:55.137830Z","submitted_at":"2023-12-06T12:03:27Z","title":"Comparative Analysis of Multilingual Text Classification & Identification through Deep Learning and Embedding Visualization","version":1},"cited_work":{"arxiv_id":"2312.03789","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.03789","snapshot_observed_at":"2026-08-07T14:23:10.562692Z","title":"Comparative Analysis of Multilingual Text Classification & Identification through Deep Learning and Embedding Visualization","venue":"cs.CL","work_id":"6a0b8406-af67-43c5-9dba-9093319d2927","year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.687067Z"},"links":{"cited_paper":"/paper/2312.03789","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:6f3255c8cc022b8d82082f9baeb0cea52c805963012b4070c00a588b04027846","observation_id":"6c2cd4ee-c235-4434-b638-0e4889e72399","resolution":{"observed_at":"2026-08-07T14:23:10.671051Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T14:23:09.768699Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.768699Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:46adbc40e35b03db499b125bef1013cde040b9a9f8eacef6513f91f6e3865961","observation_id":"a7a3f426-33c1-4464-8b6b-16fa487877a7","resolution":{"observed_at":"2026-08-07T14:23:09.768699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-07T14:23:09.891236Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.891236Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:2f72ede6d358f93475491ba76f8375f3292900052e5093468657bf97f320879e","observation_id":"66aaff17-d5f3-4014-8218-b5098907cdc5","resolution":{"observed_at":"2026-08-07T14:23:09.891236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01981","last_updated":"2024-12-02T21:20:02Z","snapshot_observed_at":"2026-08-06T03:48:05.506841Z","submitted_at":"2024-12-02T21:20:02Z","title":"Free Process Rewards without Process Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01981","snapshot_observed_at":"2026-08-07T14:23:10.024650Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:10.024650Z"},"links":{"cited_paper":"/paper/2412.01981","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:fc60ffebd041940289e87d20596be26c93c321ecadd6b74148cfd389cd026e03","observation_id":"43119fe8-f441-4f24-8e83-b64b3161fbc1","resolution":{"observed_at":"2026-08-07T14:23:10.024650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:10.133741Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:10.133741Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:6145faac61614ca4bad2abc3da5508d6252ef284057f09e95b56417769a87db0","observation_id":"8b4f4181-d43d-4af0-9aee-6f82af50aa14","resolution":{"observed_at":"2026-08-07T14:23:10.133741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T01:08:23.188199Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 4 inbound Pith citation observations for arXiv:2505.19126."}