{"as_of":"2026-08-08T17:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9c685e3d0d869e0adf670ab6224e9ed3abbec5cebe5d3bbc03aacabc137ff8f4","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:36:35.797792Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T05:46:26.938277Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.04821","doi":"10.48550/arxiv.2506.04821","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04821","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Logicpuzzlerl: Cultivating robust mathematical reasoning in llms via reinforcement learning.arXiv preprint arXiv:2506.04821","venue":"ArXiv.org","work_id":"45221a31-3bc9-4a60-9e44-6d73724d2285","year":2025},"citing_paper":{"arxiv_id":"2507.04023","last_updated":"2026-04-23T08:06:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-05T12:31:17Z","title":"Do LLMs Overthink Basic Math Reasoning? Benchmarking the Accuracy-Efficiency Tradeoff in Language Models","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-19T06:25:12.799097Z"},"links":{"cited_paper":"/paper/2506.04821","citing_paper":"/paper/2507.04023"},"observation_digest":"sha256:b34fafa266759f75955c197f0ee9f8b367dcb5ce4ce3e2a82a902b061476346d","observation_id":"623f87b7-4031-403d-98a2-f37cb1f0fdf9","resolution":{"observed_at":"2026-05-19T06:27:07.323771Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.04821","doi":"10.48550/arxiv.2506.04821","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04821","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Logicpuzzlerl: Cultivating robust mathematical reasoning in llms via reinforcement learning.arXiv preprint arXiv:2506.04821","venue":"ArXiv.org","work_id":"45221a31-3bc9-4a60-9e44-6d73724d2285","year":2025},"citing_paper":{"arxiv_id":"2604.19773","last_updated":"2026-03-27T12:13:20Z","snapshot_observed_at":"2026-08-03T12:53:29.360699Z","submitted_at":"2026-03-27T12:13:20Z","title":"PR-CAD: Progressive Refinement for Unified Controllable and Faithful Text-to-CAD Generation with Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T23:17:29.025222Z"},"links":{"cited_paper":"/paper/2506.04821","citing_paper":"/paper/2604.19773"},"observation_digest":"sha256:afa427d618f1df58d0db8a6a7aa5747c16cc5b42172e6072122b4c103da665af","observation_id":"999d9f8e-21e8-4887-9e79-2dd05598ca63","resolution":{"observed_at":"2026-05-14T23:18:15.745450Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.04821","doi":"10.48550/arxiv.2506.04821","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04821","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Logicpuzzlerl: Cultivating robust mathematical reasoning in llms via reinforcement learning.arXiv preprint arXiv:2506.04821","venue":"ArXiv.org","work_id":"45221a31-3bc9-4a60-9e44-6d73724d2285","year":2025},"citing_paper":{"arxiv_id":"2606.05464","last_updated":"2026-06-03T21:43:38Z","snapshot_observed_at":"2026-08-03T10:19:08.677126Z","submitted_at":"2026-06-03T21:43:38Z","title":"Step-by-Step Optimization-like Reasoning in LLMs over Expanding Search Spaces","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T05:46:26.938277Z"},"links":{"cited_paper":"/paper/2506.04821","citing_paper":"/paper/2606.05464"},"observation_digest":"sha256:0c2042f8e15eebf266319c3680bb42f6c2a8bf519e5ee1992ce9fadedfec36ec","observation_id":"07ecb561-819d-4d51-8b35-05de69aa6164","resolution":{"observed_at":"2026-07-02T08:46:48.925001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.04821","doi":"10.48550/arxiv.2506.04821","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04821","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Logicpuzzlerl: Cultivating robust mathematical reasoning in llms via reinforcement learning.arXiv preprint arXiv:2506.04821","venue":"ArXiv.org","work_id":"45221a31-3bc9-4a60-9e44-6d73724d2285","year":2025},"citing_paper":{"arxiv_id":"2606.06556","last_updated":"2026-06-04T10:43:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-04T10:43:14Z","title":"Robots Need More than VLA and World Models","version":1},"reference_index":150,"source":"arxiv_source","source_observed_at":"2026-06-28T01:01:33.530167Z"},"links":{"cited_paper":"/paper/2506.04821","citing_paper":"/paper/2606.06556"},"observation_digest":"sha256:cf1a081e869fd9b087f7b91f1a42c0efd42e46f592d6b18d0b4733022dfef1c4","observation_id":"fda495d6-d9a8-4a96-a2ac-0282e47ae368","resolution":{"observed_at":"2026-06-28T01:11:28.884924Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04821/citation-record","integrity":"/paper/2506.04821/integrity","json":"/paper/2506.04821/citation-record.json","paper":"/paper/2506.04821"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:36:35.553539Z","title":"H.; Ol s \\'a k, M.; Yang, X.; Nguyen, H.; Menegali, M.; Jung, J.; Verma, V.; Le, Q","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.553539Z"},"links":{"citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:60fd669f705eb3ab99f3e8d199b69911641caf562d58ae66744dfbbc3dd72051","observation_id":"60bb10ba-e173-40fe-a364-2bbf2a34bc19","resolution":{"observed_at":"2026-08-07T10:36:35.553539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T10:36:35.587424Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.587424Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:8fa78649a06b54d4eb08bcf5af7983e98f933bb5ae5b6dab5dc9e2818e655a98","observation_id":"3a740ac3-fda4-4759-89b2-cbc2857280b9","resolution":{"observed_at":"2026-08-07T10:36:35.587424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:36:36.218144Z","title":null,"venue":null,"work_id":"43b6c13a-585c-47f9-a404-a9e530fb741b","year":2025},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.669262Z"},"links":{"citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:272c9e44e84463ab00f20100310b3250bfdca733a1bf7f25181297379fbe1f2c","observation_id":"823dc748-acc7-43ca-9ddc-209620e0dde3","resolution":{"observed_at":"2026-08-07T10:36:36.222441Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11291","last_updated":"2024-09-14T06:12:36Z","snapshot_observed_at":"2026-08-04T08:05:12.722130Z","submitted_at":"2024-02-17T14:19:38Z","title":"Puzzle Solving using Reasoning of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11291","snapshot_observed_at":"2026-08-07T10:36:35.720092Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.720092Z"},"links":{"cited_paper":"/paper/2402.11291","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:eec840fa39fecc93dbc5e43024a8f33c6cb21c4ce6f652b39e054147148c79cb","observation_id":"1682acc7-86f5-49fb-b6bd-999fe06814c6","resolution":{"observed_at":"2026-08-07T10:36:35.720092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T10:36:35.729013Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.729013Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:c8ddf43abce74a8908e94c4b8f78d5afeea515b66793310f12b99f6be3129e3d","observation_id":"db483bbe-601a-4225-a1e6-25cf69b12a15","resolution":{"observed_at":"2026-08-07T10:36:35.729013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14008","last_updated":"2024-06-06T13:19:44Z","snapshot_observed_at":"2026-08-03T03:39:09.398343Z","submitted_at":"2024-02-21T18:49:26Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14008","snapshot_observed_at":"2026-08-07T10:36:35.733352Z","title":"L.; Shen, J.; Hu, J.; Han, X.; Huang, Y.; Zhang, Y.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.733352Z"},"links":{"cited_paper":"/paper/2402.14008","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:e282c63f902374b86376584edbbfb4d81f8e7dc922262d89060a805e9ae0c1fe","observation_id":"eda3e062-da76-44d8-b78c-2af5ad068bfd","resolution":{"observed_at":"2026-08-07T10:36:35.733352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T10:36:35.738540Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.738540Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:5b7bddb6c03f9262f50a0a1ca1b3e561a56f50bcb283b034be8820c6cff770f3","observation_id":"d6dee929-919a-4567-b871-7e1eaa86b420","resolution":{"observed_at":"2026-08-07T10:36:35.738540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:36:35.742751Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.742751Z"},"links":{"citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:0566f6ff9b77024cc3e5e88afb88a8465fa04c1c95482fefac1f06f463cb7072","observation_id":"ddb1a080-64b2-4276-aa7c-5464b4f3a081","resolution":{"observed_at":"2026-08-07T10:36:35.742751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01100","last_updated":"2025-07-15T01:14:25Z","snapshot_observed_at":"2026-08-07T15:35:39.413072Z","submitted_at":"2025-02-03T06:44:49Z","title":"ZebraLogic: On the Scaling Limits of LLMs for Logical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01100","snapshot_observed_at":"2026-08-07T10:36:35.746562Z","title":"Y.; Bras, R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.746562Z"},"links":{"cited_paper":"/paper/2502.01100","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:31736b6b361d07bd8137b3f0659666461d878918e4a49dafc8eeefd9e6113998","observation_id":"a0974290-344d-4535-8144-9be15832edb5","resolution":{"observed_at":"2026-08-07T10:36:35.746562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16891","last_updated":"2025-04-23T17:13:04Z","snapshot_observed_at":"2026-08-07T15:59:48.302908Z","submitted_at":"2025-04-23T17:13:04Z","title":"AIMO-2 Winning Solution: Building State-of-the-Art Mathematical Reasoning Models with OpenMathReasoning dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16891","snapshot_observed_at":"2026-08-07T10:36:35.751083Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.751083Z"},"links":{"cited_paper":"/paper/2504.16891","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:3865ffebe7a7156973be577afbeb41448b2d427b52620fa288faeb50e8998375","observation_id":"436dfa2e-86e0-4c0d-ad85-be963254fe7c","resolution":{"observed_at":"2026-08-07T10:36:35.751083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03277","last_updated":"2023-04-06T17:58:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-06T17:58:09Z","title":"Instruction Tuning with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03277","snapshot_observed_at":"2026-08-07T10:36:35.755270Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.755270Z"},"links":{"cited_paper":"/paper/2304.03277","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:7cd655d10ddb7c10c906866f12c3943b4fc03f0c71c8da4abb356c19ba6baaaa","observation_id":"013e1b47-08f1-413b-91cb-09753a8c9a6d","resolution":{"observed_at":"2026-08-07T10:36:35.755270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:36:36.194019Z","title":null,"venue":null,"work_id":"7a0f844a-3d54-4a4f-b54c-43145aa246dd","year":2017},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.759659Z"},"links":{"citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:01308e7322862e1f041278da03489fb3db404dc8a1e31697d1cdcc39c8ca5c61","observation_id":"80a8c158-7aef-491f-89e5-9a5cb7030b09","resolution":{"observed_at":"2026-08-07T10:36:36.199387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21801","last_updated":"2025-07-18T08:20:23Z","snapshot_observed_at":"2026-08-02T11:46:58.603316Z","submitted_at":"2025-04-30T16:57:48Z","title":"DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21801","snapshot_observed_at":"2026-08-07T10:36:35.764026Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.764026Z"},"links":{"cited_paper":"/paper/2504.21801","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:a9f2972f0fe26ec4ba8a025101a16319abc75384b518408d7c60fada87739ac5","observation_id":"975b78e7-bd62-4b63-be5b-a04e75c8c1de","resolution":{"observed_at":"2026-08-07T10:36:35.764026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:36:35.768129Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.768129Z"},"links":{"citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:353f3baff9c6c60931a9dd5d484b6f91a55df1e96eea4dca8093cc7096bba450","observation_id":"6f1a336d-4493-44be-abff-52b47b38eadc","resolution":{"observed_at":"2026-08-07T10:36:35.768129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.01815","last_updated":"2017-12-05T18:45:38Z","snapshot_observed_at":"2026-08-02T00:39:04.960144Z","submitted_at":"2017-12-05T18:45:38Z","title":"Mastering Chess and Shogi by Self-Play with a General Reinforcement Learning Algorithm","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.01815","snapshot_observed_at":"2026-08-07T10:36:35.772152Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.772152Z"},"links":{"cited_paper":"/paper/1712.01815","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:2ba1556aa53be134e5b7e13a7624474428fee61b04d237416f5307656c4589ed","observation_id":"eb642055-069f-49a9-a58c-65798539348c","resolution":{"observed_at":"2026-08-07T10:36:35.772152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T10:36:35.776289Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.776289Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:6cb4cf570e0eb7fad4b76360b373f6eedc38adeb8a8bf3f39940aaf05b846ab8","observation_id":"bf4644b6-9ade-4cd6-be97-82153afcb6d6","resolution":{"observed_at":"2026-08-07T10:36:35.776289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11354","last_updated":"2025-04-15T16:23:44Z","snapshot_observed_at":"2026-08-03T03:38:06.953412Z","submitted_at":"2025-04-15T16:23:44Z","title":"Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11354","snapshot_observed_at":"2026-08-07T10:36:35.780423Z","title":"D.; Sung, F.; Vinyes, M.; Ying, Z.; Zhu, Z.; et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.780423Z"},"links":{"cited_paper":"/paper/2504.11354","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:2b0213fc958e9efc7de201bfd19a4d2a3ad4185a126471926f7e963775fb54be","observation_id":"80cd305b-df40-4fd1-a4b1-858eaebb26a4","resolution":{"observed_at":"2026-08-07T10:36:35.780423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09686","snapshot_observed_at":"2026-08-07T10:36:35.784341Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.784341Z"},"links":{"cited_paper":"/paper/2501.09686","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:105a2f3083f7bcab257276f3470e0395434a87c2f956017faf9eac0fe5db40ea","observation_id":"887d9805-7ec3-461b-a203-4cb49fa4379a","resolution":{"observed_at":"2026-08-07T10:36:35.784341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06122","last_updated":"2025-07-14T04:41:15Z","snapshot_observed_at":"2026-08-07T16:07:28.977536Z","submitted_at":"2025-04-08T15:15:26Z","title":"Leanabell-Prover: Posttraining Scaling in Formal Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06122","snapshot_observed_at":"2026-08-07T10:36:35.788897Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.788897Z"},"links":{"cited_paper":"/paper/2504.06122","citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:808239fe4ad68a81c62d15fc4f8c505648b5951ea463dac34bdce9e2c370cc8e","observation_id":"af310fad-6d59-4dd3-bc84-cfa9d1623182","resolution":{"observed_at":"2026-08-07T10:36:35.788897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:36:35.793331Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.793331Z"},"links":{"citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:4b29633a7295d301ee3355e1e80c3518e1f49ec992bd1ad3e664fd5a7fb5cb8d","observation_id":"e6724016-5825-423b-99c1-3eb68387ef20","resolution":{"observed_at":"2026-08-07T10:36:35.793331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:36:35.797792Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:36:35.797792Z"},"links":{"citing_paper":"/paper/2506.04821"},"observation_digest":"sha256:07d3a8fa719bffbdce9f7fa5926bfb6117a46a6b0b953f5dea49f2e0e46fe094","observation_id":"0b5b9d75-a6e3-4e33-a920-9d2850aa4bf7","resolution":{"observed_at":"2026-08-07T10:36:35.797792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.04821","last_updated":"2025-06-05T09:40:47Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T11:33:31.128504Z","submitted_at":"2025-06-05T09:40:47Z","title":"LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 4 inbound Pith citation observations for arXiv:2506.04821."}