{"as_of":"2026-08-08T21:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:db4e366be1376c41d91703d509bfb1cdbaeaa4177d5bcbcb3ca6b5e86c470b64","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":27,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:45:46.479498Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-10T12:15:01.137692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":"2503.21934","doi":"10.48550/arxiv.2503.21934","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Purvis, B., Mao, Y., and Robinson, D","venue":null,"work_id":"3b6d416a-64c2-4ae2-8ac0-05d906a83bba","year":2025},"citing_paper":{"arxiv_id":"2504.13217","last_updated":"2026-05-18T14:05:55Z","snapshot_observed_at":"2026-08-01T15:57:04.534831Z","submitted_at":"2025-04-17T04:00:40Z","title":"Sustainability via LLM Right-sizing","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T19:24:58.690462Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2504.13217"},"observation_digest":"sha256:d4dcb3a839c653b321bf3164043107b9c2d7e4b043f82a7155048f9f56066d0c","observation_id":"7186d4e3-47cb-4a87-8547-e1c4c2413e5e","resolution":{"observed_at":"2026-05-22T19:25:03.677934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":"2503.21934","doi":"10.48550/arxiv.2503.21934","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Purvis, B., Mao, Y., and Robinson, D","venue":null,"work_id":"3b6d416a-64c2-4ae2-8ac0-05d906a83bba","year":2025},"citing_paper":{"arxiv_id":"2504.21318","last_updated":"2025-04-30T05:05:09Z","snapshot_observed_at":"2026-08-08T08:43:53.657438Z","submitted_at":"2025-04-30T05:05:09Z","title":"Phi-4-reasoning Technical Report","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-17T03:40:25.706499Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2504.21318"},"observation_digest":"sha256:601bffeb6cdba314781f6afdddaeffbb4866a7699569ed671781021f04abaf90","observation_id":"2ef8e4b6-d6f6-4472-a70a-31803eb8d840","resolution":{"observed_at":"2026-05-17T03:40:25.739163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":"2503.21934","doi":"10.48550/arxiv.2503.21934","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Purvis, B., Mao, Y., and Robinson, D","venue":null,"work_id":"3b6d416a-64c2-4ae2-8ac0-05d906a83bba","year":2025},"citing_paper":{"arxiv_id":"2505.23281","last_updated":"2026-01-14T21:39:58Z","snapshot_observed_at":"2026-08-02T10:05:44.330694Z","submitted_at":"2025-05-29T09:28:06Z","title":"MathArena: Evaluating LLMs on Uncontaminated Math Competitions","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T00:10:14.812539Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2505.23281"},"observation_digest":"sha256:e7cd584245de0cf4733cb9aa76121e0974848e031f37536a59c70d3c8452638e","observation_id":"4ca2fab4-917f-4e1c-ae7a-11af97afdb54","resolution":{"observed_at":"2026-05-15T00:10:14.866036Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-07T12:45:46.479498Z","title":"Petrov, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23881","last_updated":"2025-05-29T17:45:50Z","snapshot_observed_at":"2026-08-08T16:53:18.849917Z","submitted_at":"2025-05-29T17:45:50Z","title":"Using Reasoning Models to Generate Search Heuristics that Solve Open Instances of Combinatorial Design Problems","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:46.479498Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2505.23881"},"observation_digest":"sha256:65d508f64bb99d5b20c43b55cf212a3ca278d27ac7282599f51fb6c8781d509a","observation_id":"dcbe21ce-9286-46e4-961d-606652a4cf72","resolution":{"observed_at":"2026-08-07T12:45:46.479498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-07T05:50:49.653031Z","title":"correct answers via flawed reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-08T19:07:07.122029Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:49.653031Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:2e236153e974e00b054ddb367b68d59e98d16f333b08a12948dbbe0cf64fe8a4","observation_id":"b12c2113-dbc3-4f3b-bc7e-d081fa75d0cf","resolution":{"observed_at":"2026-08-07T05:50:49.653031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-07T04:09:10.154073Z","title":"Proof or bluff? evaluating llms on 2025 usa math olympiad","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11487","last_updated":"2025-06-13T06:25:59Z","snapshot_observed_at":"2026-08-07T23:35:00.623427Z","submitted_at":"2025-06-13T06:25:59Z","title":"Reviving DSP for Advanced Theorem Proving in the Era of Reasoning Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:09:10.154073Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2506.11487"},"observation_digest":"sha256:7fddcb5fe8efaea6fc3976f7a627fc3c4fc178c3a671193da98db08ca6b69b1c","observation_id":"8987591d-b5bf-43a3-a7f3-650d244d6e3a","resolution":{"observed_at":"2026-08-07T04:09:10.154073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-06T23:35:25.107443Z","title":"Petrov, Y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17219","last_updated":"2025-06-25T13:27:49Z","snapshot_observed_at":"2026-08-07T08:57:51.827843Z","submitted_at":"2025-06-20T17:59:52Z","title":"No Free Lunch: Rethinking Internal Feedback for LLM Reasoning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:35:25.107443Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2506.17219"},"observation_digest":"sha256:71342ed7ecd739148ba75ae3191bb4e78d56e90242d3ff88d357d654dcf236bc","observation_id":"4447a8c4-0263-42a2-a4c4-cadde5a67f21","resolution":{"observed_at":"2026-08-06T23:35:25.107443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-06T21:10:06.635014Z","title":"Proof or bluff? evaluating llms on 2025 usa math olympiad","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00829","last_updated":"2025-07-01T15:01:18Z","snapshot_observed_at":"2026-08-08T03:47:45.535102Z","submitted_at":"2025-07-01T15:01:18Z","title":"On the Surprising Efficacy of LLMs for Penetration-Testing","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T21:10:06.635014Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2507.00829"},"observation_digest":"sha256:fa62b0f3cfbfb143265f3b168dc7294978dda7a97707e7817fdbadeb53fd5ba1","observation_id":"571dd12d-aa7e-403e-bd5d-1c666edd50f7","resolution":{"observed_at":"2026-08-06T21:10:06.635014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-06T10:30:44.646893Z","title":"Proof or bluff? evaluating llms on 2025 usa math olympiad, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23726","last_updated":"2025-08-01T03:36:47Z","snapshot_observed_at":"2026-08-07T12:23:31.292936Z","submitted_at":"2025-07-31T17:00:30Z","title":"Seed-Prover: Deep and Broad Reasoning for Automated Theorem Proving","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:44.646893Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2507.23726"},"observation_digest":"sha256:aaab919ba109f2d65d634890f7740a74fa5d4b5108ea157c46f37c8ae313440c","observation_id":"0e0d4d6e-709f-4c24-9038-60039d47a15a","resolution":{"observed_at":"2026-08-06T10:30:44.646893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-05T20:17:11.057856Z","title":"Proof or bluff? evaluating llms on 2025 usa math olympiad","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10874","last_updated":"2025-08-14T17:46:01Z","snapshot_observed_at":"2026-08-06T03:19:32.559275Z","submitted_at":"2025-08-14T17:46:01Z","title":"SSRL: Self-Search Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T20:17:11.057856Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2508.10874"},"observation_digest":"sha256:4acbc6a636be36925cf7fe3f385d4e6c77ded91292a744e62c0440ddce4139d2","observation_id":"bbf8efaf-4312-4d5e-984a-68622d4d12cc","resolution":{"observed_at":"2026-08-05T20:17:11.057856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-05T15:18:07.713740Z","title":"et al.\\ (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20236","last_updated":"2025-08-27T19:33:48Z","snapshot_observed_at":"2026-08-07T17:15:36.477528Z","submitted_at":"2025-08-27T19:33:48Z","title":"The Mathematician's Assistant: Integrating AI into Research Practice","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:07.713740Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2508.20236"},"observation_digest":"sha256:3be5ddcf1cf9cc9ef2e06e66c7fc0d076166513b0d6deed8af6dbfb681220bf6","observation_id":"5ca9addc-564d-4e46-9b2c-6d37d151fd36","resolution":{"observed_at":"2026-08-05T15:18:07.713740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":"2503.21934","doi":"10.48550/arxiv.2503.21934","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Purvis, B., Mao, Y., and Robinson, D","venue":null,"work_id":"3b6d416a-64c2-4ae2-8ac0-05d906a83bba","year":2025},"citing_paper":{"arxiv_id":"2509.21820","last_updated":"2026-05-17T15:22:35Z","snapshot_observed_at":"2026-07-06T22:30:50.642382Z","submitted_at":"2025-09-26T03:26:28Z","title":"Can LLMs Generate and Solve Linguistic Olympiad Puzzles?","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T22:41:03.883239Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2509.21820"},"observation_digest":"sha256:49f7ea02ea5f39393f0a506f284c52dfc95f1ffe9bedb2576104cc3c9ae2df6d","observation_id":"715d8491-2da2-4694-8254-8e41e9adfdcd","resolution":{"observed_at":"2026-05-21T22:44:24.438380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-04T09:38:46.119576Z","title":"Proof or bluff? evaluating llms on 2025 usa math olympiad","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.14717","last_updated":"2026-07-27T17:12:10Z","snapshot_observed_at":"2026-08-07T22:51:49.378334Z","submitted_at":"2025-10-16T14:17:38Z","title":"Seesaw: Accelerating Training by Balancing Learning Rate and Batch Size Scheduling","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T09:38:46.119576Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2510.14717"},"observation_digest":"sha256:d87c86325774167a72d8ab01316afa444fc56473109e1fdca69f0f83eedd3e9f","observation_id":"78430be8-a216-4003-9f15-1a71ccf2654b","resolution":{"observed_at":"2026-08-04T09:38:46.119576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-04T08:15:55.662016Z","title":"Proof or bluff? evaluating llms on 2025 usa math olympiad","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.21978","last_updated":"2026-06-18T16:29:38Z","snapshot_observed_at":"2026-08-04T08:15:30.884838Z","submitted_at":"2025-10-24T19:08:48Z","title":"Beyond Reasoning Gains: Mitigating General-Capability Forgetting in Large Reasoning Models","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-04T08:15:55.662016Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2510.21978"},"observation_digest":"sha256:95bce36d7c2773b8ae6d6eb583a53ad76f1e39afec9420e2456227398d059f74","observation_id":"d590de59-60f5-4031-b38e-81c170d6b9f8","resolution":{"observed_at":"2026-08-04T08:15:55.662016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":"2503.21934","doi":"10.48550/arxiv.2503.21934","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Purvis, B., Mao, Y., and Robinson, D","venue":null,"work_id":"3b6d416a-64c2-4ae2-8ac0-05d906a83bba","year":2025},"citing_paper":{"arxiv_id":"2511.02521","last_updated":"2026-06-25T18:44:49Z","snapshot_observed_at":"2026-08-08T15:44:37.846407Z","submitted_at":"2025-11-04T12:16:37Z","title":"Large Lemma Miners: Can LLMs do Induction Proofs for Hardware?","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T01:34:03.866227Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2511.02521"},"observation_digest":"sha256:faa3b95b0cefc769a47db91b1bd59e2e55c2ca9f3e46ab7cb56dff1e2d55d38e","observation_id":"162e4100-9614-4493-bb65-7b9fe7071677","resolution":{"observed_at":"2026-05-18T01:35:36.417510Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-04T00:14:48.500366Z","title":"Proof or bluff? Evaluating LLMs on 2025 USA Math Olympiad,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.02521","last_updated":"2026-06-25T18:44:49Z","snapshot_observed_at":"2026-08-08T15:44:37.846407Z","submitted_at":"2025-11-04T12:16:37Z","title":"Large Lemma Miners: Can LLMs do Induction Proofs for Hardware?","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T00:14:48.500366Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2511.02521"},"observation_digest":"sha256:293a33f241e3677f1811ba2424a32347bc2940f8b4eeba1b25a23b72357c28ad","observation_id":"1f532c31-8a77-484c-b75e-edff271502d6","resolution":{"observed_at":"2026-08-04T00:14:48.500366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":"2503.21934","doi":"10.48550/arxiv.2503.21934","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Purvis, B., Mao, Y., and Robinson, D","venue":null,"work_id":"3b6d416a-64c2-4ae2-8ac0-05d906a83bba","year":2025},"citing_paper":{"arxiv_id":"2511.10899","last_updated":"2026-04-20T20:17:21Z","snapshot_observed_at":"2026-08-07T12:57:16.842925Z","submitted_at":"2025-11-14T02:21:34Z","title":"From Proof to Program: Characterizing Tool-Induced Reasoning Hallucinations in Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T22:47:21.466578Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2511.10899"},"observation_digest":"sha256:3e9f54b251b28b87b2c950072a71ce67f22fb1df9d44a535144687eccbb37d2b","observation_id":"eda4132e-139b-44ba-80ff-6ec655e83baa","resolution":{"observed_at":"2026-05-17T22:50:25.760811Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-02T21:18:02.701570Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.20629","last_updated":"2026-07-06T08:57:26Z","snapshot_observed_at":"2026-08-03T11:13:09.928353Z","submitted_at":"2026-02-24T07:23:28Z","title":"QEDBENCH: Quantifying the Alignment Gap in Automated Evaluation of University-Level Mathematical Proofs","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T21:18:02.701570Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2602.20629"},"observation_digest":"sha256:b2fe400c728d769adebd52364d40988408fb1e12880df49ca84fd26626d0c283","observation_id":"0035540d-fb83-4987-bc0c-cb155b3a6f18","resolution":{"observed_at":"2026-08-02T21:18:02.701570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":"2503.21934","doi":"10.48550/arxiv.2503.21934","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Purvis, B., Mao, Y., and Robinson, D","venue":null,"work_id":"3b6d416a-64c2-4ae2-8ac0-05d906a83bba","year":2025},"citing_paper":{"arxiv_id":"2604.03216","last_updated":"2026-04-03T17:44:32Z","snapshot_observed_at":"2026-07-06T22:52:25.307426Z","submitted_at":"2026-04-03T17:44:32Z","title":"BAS: A Decision-Theoretic Approach to Evaluating Large Language Model Confidence","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-13T19:48:13.133733Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2604.03216"},"observation_digest":"sha256:8c27e552e312c8b541b2c90ee9c64d73a86760030e57d2d44d28b8182fc1c824","observation_id":"e0c75cff-7f64-4eac-920f-2f3dfe992c03","resolution":{"observed_at":"2026-05-13T19:53:11.895410Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":"2503.21934","doi":"10.48550/arxiv.2503.21934","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Purvis, B., Mao, Y., and Robinson, D","venue":null,"work_id":"3b6d416a-64c2-4ae2-8ac0-05d906a83bba","year":2025},"citing_paper":{"arxiv_id":"2604.07593","last_updated":"2026-06-17T23:58:56Z","snapshot_observed_at":"2026-07-13T08:26:43.817939Z","submitted_at":"2026-04-08T20:51:00Z","title":"Too long; didn't solve","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T17:29:25.830962Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2604.07593"},"observation_digest":"sha256:8c7b66fa1645d9ea21b50962d7073ba93e6b48cbfa452a1b64a9d998f00bcf03","observation_id":"1129824b-89c7-44b2-82c9-e4c788d514e5","resolution":{"observed_at":"2026-05-11T06:41:43.452726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-13T08:26:49.097626Z","title":"ArXiv:2503.21934","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.07593","last_updated":"2026-06-17T23:58:56Z","snapshot_observed_at":"2026-07-13T08:26:43.817939Z","submitted_at":"2026-04-08T20:51:00Z","title":"Too long; didn't solve","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T08:26:49.097626Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2604.07593"},"observation_digest":"sha256:8e7f5893efbf323c7a73dcc8de7db0e6e50897c835ed46a549e0c4bcfa54e9a2","observation_id":"e45c6353-82eb-4015-b797-cac984145015","resolution":{"observed_at":"2026-07-13T08:26:49.097626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":"2503.21934","doi":"10.48550/arxiv.2503.21934","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Purvis, B., Mao, Y., and Robinson, D","venue":null,"work_id":"3b6d416a-64c2-4ae2-8ac0-05d906a83bba","year":2025},"citing_paper":{"arxiv_id":"2605.10379","last_updated":"2026-06-25T12:27:46Z","snapshot_observed_at":"2026-08-02T09:07:37.225294Z","submitted_at":"2026-05-11T11:23:36Z","title":"Not All Proofs Are Equal: Evaluating LLM Proof Quality Beyond Correctness","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T04:46:50.177357Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2605.10379"},"observation_digest":"sha256:d97bc58c8c659cc82a464f2f5d0bb421e049be4681a1219fba859069a33d8b19","observation_id":"c45d02b1-4c41-4f6c-85c3-de7936e8e9e8","resolution":{"observed_at":"2026-05-12T04:56:24.283023Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":"2503.21934","doi":"10.48550/arxiv.2503.21934","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Purvis, B., Mao, Y., and Robinson, D","venue":null,"work_id":"3b6d416a-64c2-4ae2-8ac0-05d906a83bba","year":2025},"citing_paper":{"arxiv_id":"2605.10379","last_updated":"2026-06-25T12:27:46Z","snapshot_observed_at":"2026-08-02T09:07:37.225294Z","submitted_at":"2026-05-11T11:23:36Z","title":"Not All Proofs Are Equal: Evaluating LLM Proof Quality Beyond Correctness","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T22:38:26.111517Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2605.10379"},"observation_digest":"sha256:9f3e122443c1812e94ca6f8e42f4f85541132a4741e4d38aa2ab1b7cd0004659","observation_id":"73d9f5fc-d150-4c4f-9873-3d0072549cdd","resolution":{"observed_at":"2026-06-30T22:45:06.649026Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":"2503.21934","doi":"10.48550/arxiv.2503.21934","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Purvis, B., Mao, Y., and Robinson, D","venue":null,"work_id":"3b6d416a-64c2-4ae2-8ac0-05d906a83bba","year":2025},"citing_paper":{"arxiv_id":"2605.19338","last_updated":"2026-05-19T04:20:43Z","snapshot_observed_at":"2026-07-06T23:30:06.876413Z","submitted_at":"2026-05-19T04:20:43Z","title":"STAR-P\\'olyaMath: Multi-Agent Reasoning under Persistent Meta-Strategic Supervision","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T02:56:19.104905Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2605.19338"},"observation_digest":"sha256:46b038c0a5ef7f06d02676261363a1d4e33a868fd86eb0d4e241a97c9ac173b6","observation_id":"16bf2f75-0898-41af-8055-9dfe13d1d263","resolution":{"observed_at":"2026-05-20T02:58:00.106348Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":"2503.21934","doi":"10.48550/arxiv.2503.21934","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Purvis, B., Mao, Y., and Robinson, D","venue":null,"work_id":"3b6d416a-64c2-4ae2-8ac0-05d906a83bba","year":2025},"citing_paper":{"arxiv_id":"2606.24020","last_updated":"2026-06-22T23:54:00Z","snapshot_observed_at":"2026-08-06T15:08:13.351860Z","submitted_at":"2026-06-22T23:54:00Z","title":"You Don't Need to Run Every Eval","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-06-26T08:23:12.145516Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2606.24020"},"observation_digest":"sha256:dbd371935a62e8e3c1d25ac8288a661a5f8bc30a1b118b933bb0908f20e5f017","observation_id":"59f5b090-c75d-4a59-ac2b-895f994e0604","resolution":{"observed_at":"2026-07-04T10:49:46.943151Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-04T04:58:06.574894Z","title":"Proof or Bluff? Evaluating","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00004","last_updated":"2026-05-29T17:22:57Z","snapshot_observed_at":"2026-08-08T01:43:29.405064Z","submitted_at":"2026-05-29T17:22:57Z","title":"Cost-Effective Automated Judging of Natural-Language Mathematical Proofs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T04:58:06.574894Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2608.00004"},"observation_digest":"sha256:bd53b6f87477fac013b017a2256b4f9b26d7f60c2aea0b9548f1f1772e5e04b9","observation_id":"39d0ecde-988c-48a8-be4b-60096152efd9","resolution":{"observed_at":"2026-08-04T04:58:06.574894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-06T00:08:25.854976Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01522","last_updated":"2026-08-02T22:19:01Z","snapshot_observed_at":"2026-08-06T23:26:58.684733Z","submitted_at":"2026-08-02T22:19:01Z","title":"Question Begets Question: Self-Evolving Curriculum for Reinforcement Fine-Tuning on Competition Mathematics","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T00:08:25.854976Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2608.01522"},"observation_digest":"sha256:3660cc34f09680766f3bf593eb7414531fe13669c25776efaf61fb5223625fa1","observation_id":"bf24a7a1-9fe9-4d55-b960-91b809835627","resolution":{"observed_at":"2026-08-06T00:08:25.854976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.21934/citation-record","integrity":"/paper/2503.21934/integrity","json":"/paper/2503.21934/citation-record.json","paper":"/paper/2503.21934"},"outbound":[],"paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","latest_version":5,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T16:31:45.129185Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 27 inbound Pith citation observations for arXiv:2503.21934."}