{"as_of":"2026-08-07T18:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e86e00f2e7966d278c19b8ed6daf9e05042397487693cecaa071938b325b1c71","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:40:20.293962Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:39:56.905741Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-07T12:39:56.905741Z","title":"Stephan Lukasczyk and Gordon Fraser","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24098","last_updated":"2025-05-30T01:00:34Z","snapshot_observed_at":"2026-08-07T12:32:37.644168Z","submitted_at":"2025-05-30T01:00:34Z","title":"HardTests: Synthesizing High-Quality Test Cases for LLM Coding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:56.905741Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2505.24098"},"observation_digest":"sha256:0d1a80018d7bf190cb74ba3c3ebe8e31652c0fda6fc2517e15914f0a52379877","observation_id":"4fe2febf-5736-49ce-ae1f-f9eefc4f3563","resolution":{"observed_at":"2026-08-07T12:39:56.905741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-07T00:24:14.823958Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset.arXiv preprint arXiv:2505.21297, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14234","last_updated":"2025-06-17T06:47:19Z","snapshot_observed_at":"2026-08-07T00:15:52.455187Z","submitted_at":"2025-06-17T06:47:19Z","title":"Xolver: Multi-Agent Reasoning with Holistic Experience Learning Just Like an Olympiad Team","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:24:14.823958Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2506.14234"},"observation_digest":"sha256:de36ebd1cbc4d8fa9a8b83a1001143e2d7f33d61c7bacc8ce8a7ad82d13b852a","observation_id":"5737eabc-8cf1-4b86-ad60-e01076865642","resolution":{"observed_at":"2026-08-07T00:24:14.823958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-06T00:58:28.854908Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05686","last_updated":"2025-08-06T05:04:14Z","snapshot_observed_at":"2026-08-06T00:58:26.026153Z","submitted_at":"2025-08-06T05:04:14Z","title":"Efficiency of turbulence","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:58:28.854908Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2508.05686"},"observation_digest":"sha256:8a9c367261c7fb0a195e972846f1eb29a69e7ba56f730083be94ae7faee68827","observation_id":"c4783c4d-9b91-40d1-b317-424793164e81","resolution":{"observed_at":"2026-08-06T00:58:28.854908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T16:32:54.565609Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18255","last_updated":"2025-09-02T17:12:12Z","snapshot_observed_at":"2026-08-07T11:24:40.152570Z","submitted_at":"2025-08-25T17:45:06Z","title":"Hermes 4 Technical Report","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T16:32:54.565609Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2508.18255"},"observation_digest":"sha256:431d06bd3d931e474f67e0af4b4cce86445d119bd59aca7d6b7d6daf20fd8a9c","observation_id":"704f9051-ab95-404c-92f1-ef3064d75831","resolution":{"observed_at":"2026-08-05T16:32:54.565609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":"2505.21297","doi":"10.48550/arxiv.2505.21297","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset","venue":"ArXiv.org","work_id":"5a295f3e-abb9-4b86-877d-9e769b28069e","year":2025},"citing_paper":{"arxiv_id":"2512.00127","last_updated":"2026-04-27T09:10:32Z","snapshot_observed_at":"2026-07-06T22:37:16.933664Z","submitted_at":"2025-11-28T07:43:43Z","title":"Generating Verifiable Chain of Thoughts from Exection-Traces","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-17T05:17:10.692544Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2512.00127"},"observation_digest":"sha256:c4148ad6d7e8a8dc644a92200925335620b2a9f7709304fd4aa251890f383b57","observation_id":"c76a4272-a573-4d42-b4c2-841bcc948115","resolution":{"observed_at":"2026-05-17T05:19:04.874552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":"2505.21297","doi":"10.48550/arxiv.2505.21297","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset","venue":"ArXiv.org","work_id":"5a295f3e-abb9-4b86-877d-9e769b28069e","year":2025},"citing_paper":{"arxiv_id":"2512.18552","last_updated":"2026-06-02T06:06:43Z","snapshot_observed_at":"2026-08-03T15:02:08.953642Z","submitted_at":"2025-12-21T00:49:40Z","title":"Toward Training Superintelligent Software Agents through Self-Play SWE-RL","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-21T16:07:48.570995Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2512.18552"},"observation_digest":"sha256:5644ba3dc28bd10a79f9011695c35c1338c3ff4090926fbf5a81b34717de0c06","observation_id":"3b969afe-a100-4c04-a8c7-9aa829807994","resolution":{"observed_at":"2026-05-21T16:10:20.304045Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-03T15:02:12.542382Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.18552","last_updated":"2026-06-02T06:06:43Z","snapshot_observed_at":"2026-08-03T15:02:08.953642Z","submitted_at":"2025-12-21T00:49:40Z","title":"Toward Training Superintelligent Software Agents through Self-Play SWE-RL","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T15:02:12.542382Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2512.18552"},"observation_digest":"sha256:b82bcf5edd115b99f717551aa9c6d4021e0b7dd59c06c7dc59f091d9c2904942","observation_id":"a1596c99-53ba-4181-8721-18c2a9ed6bb6","resolution":{"observed_at":"2026-08-03T15:02:12.542382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-07-13T14:33:35.834383Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset.CoRR, abs/2505.21297,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.01193","last_updated":"2026-06-24T22:44:36Z","snapshot_observed_at":"2026-08-02T16:28:38.685624Z","submitted_at":"2026-04-01T17:39:50Z","title":"Embarrassingly Simple Self-Distillation Improves Code Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T14:33:35.834383Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2604.01193"},"observation_digest":"sha256:ee96e5fd1e023be86e7b47562b17fb892a74b0f55aa28eb5b11f01fa3e0350b9","observation_id":"22512446-27c3-4a5f-b5ba-4a950ea1026b","resolution":{"observed_at":"2026-07-13T14:33:35.834383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":"2505.21297","doi":"10.48550/arxiv.2505.21297","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset","venue":"ArXiv.org","work_id":"5a295f3e-abb9-4b86-877d-9e769b28069e","year":2025},"citing_paper":{"arxiv_id":"2604.02721","last_updated":"2026-04-03T04:26:56Z","snapshot_observed_at":"2026-08-01T01:27:54.176469Z","submitted_at":"2026-04-03T04:26:56Z","title":"GrandCode: Achieving Grandmaster Level in Competitive Programming via Agentic Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T20:30:17.791973Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2604.02721"},"observation_digest":"sha256:6eae6a29a78b83c88ca94f828770260df10f2b8fa3b6abf9b54432f0d5cf589d","observation_id":"96f2c97f-4264-4fa9-88ac-eb272e781965","resolution":{"observed_at":"2026-05-13T20:33:16.592695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":"2505.21297","doi":"10.48550/arxiv.2505.21297","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset","venue":"ArXiv.org","work_id":"5a295f3e-abb9-4b86-877d-9e769b28069e","year":2025},"citing_paper":{"arxiv_id":"2604.21598","last_updated":"2026-04-28T05:10:28Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:21:03Z","title":"You Don't Need Public Tests to Generate Correct Code","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T20:57:43.802195Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2604.21598"},"observation_digest":"sha256:687ec8469d2fa3578e96e7b22cfcb0db2260c0bb097f0e38b469fe9668fd34c9","observation_id":"0bd7f13a-1df7-42bc-a8ed-2af1a25489b0","resolution":{"observed_at":"2026-05-09T20:58:06.456959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":"2505.21297","doi":"10.48550/arxiv.2505.21297","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset","venue":"ArXiv.org","work_id":"5a295f3e-abb9-4b86-877d-9e769b28069e","year":2025},"citing_paper":{"arxiv_id":"2605.07248","last_updated":"2026-05-08T05:09:18Z","snapshot_observed_at":"2026-07-31T10:36:03.832969Z","submitted_at":"2026-05-08T05:09:18Z","title":"PaT: Planning-after-Trial for Efficient Test-Time Code Generation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-11T02:39:41.247353Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2605.07248"},"observation_digest":"sha256:80f81994a9bfd5bb5dcd40e1875d812a8a315356264f15d4f9eda8e87cc94a8b","observation_id":"2d08fc99-79e2-4780-b589-6841fcddfe49","resolution":{"observed_at":"2026-05-11T02:45:59.015551Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":"2505.21297","doi":"10.48550/arxiv.2505.21297","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset","venue":"ArXiv.org","work_id":"5a295f3e-abb9-4b86-877d-9e769b28069e","year":2025},"citing_paper":{"arxiv_id":"2605.11299","last_updated":"2026-05-13T03:29:35Z","snapshot_observed_at":"2026-07-06T23:23:11.928199Z","submitted_at":"2026-05-11T22:34:45Z","title":"Primal Generation, Dual Judgment: Self-Training from Test-Time Scaling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T02:25:58.830629Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2605.11299"},"observation_digest":"sha256:8a22f2f1997879ce95a71f686cb2634d8050c69f6c754309b3ca6c8bc1fcfbbf","observation_id":"b5cd3b4d-275f-4a7a-bbc8-507aa9f4925a","resolution":{"observed_at":"2026-05-13T02:27:07.007259Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":"2505.21297","doi":"10.48550/arxiv.2505.21297","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset","venue":"ArXiv.org","work_id":"5a295f3e-abb9-4b86-877d-9e769b28069e","year":2025},"citing_paper":{"arxiv_id":"2605.11299","last_updated":"2026-05-13T03:29:35Z","snapshot_observed_at":"2026-07-06T23:23:11.928199Z","submitted_at":"2026-05-11T22:34:45Z","title":"Primal Generation, Dual Judgment: Self-Training from Test-Time Scaling","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-14T20:46:38.558668Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2605.11299"},"observation_digest":"sha256:bc58ab997b7c0c28aa776baffc9a2d5790eaaa17bda3bcdc7c82b6b433239dab","observation_id":"e9ff6463-e654-470b-8983-92d96f4f0f0f","resolution":{"observed_at":"2026-05-14T20:47:58.045025Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":"2505.21297","doi":"10.48550/arxiv.2505.21297","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset","venue":"ArXiv.org","work_id":"5a295f3e-abb9-4b86-877d-9e769b28069e","year":2025},"citing_paper":{"arxiv_id":"2606.11052","last_updated":"2026-06-09T16:17:19Z","snapshot_observed_at":"2026-08-05T14:17:36.486236Z","submitted_at":"2026-06-09T16:17:19Z","title":"Attention Amnesia in Hybrid LLMs: When CoT Fine-Tuning Breaks Long-Range Recall, and How to Fix It","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-27T13:08:57.218711Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2606.11052"},"observation_digest":"sha256:fde086b541e43b98675ec4fc43bf22842b8b796c57445b931197c7865de5f034","observation_id":"bceb5667-4686-4c9d-bc69-7f142d9461ad","resolution":{"observed_at":"2026-06-27T13:10:55.902231Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":"2505.21297","doi":"10.48550/arxiv.2505.21297","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset","venue":"ArXiv.org","work_id":"5a295f3e-abb9-4b86-877d-9e769b28069e","year":2025},"citing_paper":{"arxiv_id":"2606.17682","last_updated":"2026-06-16T08:48:58Z","snapshot_observed_at":"2026-08-01T05:53:08.805029Z","submitted_at":"2026-06-16T08:48:58Z","title":"From Trainee to Trainer: LLM-Designed Training Environment for RL with Multi-Agent Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-27T00:59:50.038405Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2606.17682"},"observation_digest":"sha256:1dd9cb948e19ded57d6121558e71dcbe61e13b7727b7123410f7881f15ea8f75","observation_id":"6a2d1e07-d050-4cc4-a8be-f141e3950cc7","resolution":{"observed_at":"2026-06-27T01:00:19.836473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":"2505.21297","doi":"10.48550/arxiv.2505.21297","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset","venue":"ArXiv.org","work_id":"5a295f3e-abb9-4b86-877d-9e769b28069e","year":2025},"citing_paper":{"arxiv_id":"2606.25450","last_updated":"2026-06-25T16:37:45Z","snapshot_observed_at":"2026-08-02T04:58:05.165698Z","submitted_at":"2026-06-24T06:26:02Z","title":"The Generalization Spectrum: A Chromatographic Approach to Evaluating Learning Algorithms","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-25T20:55:15.784610Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2606.25450"},"observation_digest":"sha256:22e12f4bfc5748598ea37ab0809b34a9fb8d9b2b2ab0a92459ccc6cbdca5e25b","observation_id":"b8b7c27f-5878-44bc-a3f6-d2ab35964a23","resolution":{"observed_at":"2026-07-04T20:00:08.054031Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":"2505.21297","doi":"10.48550/arxiv.2505.21297","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset","venue":"ArXiv.org","work_id":"5a295f3e-abb9-4b86-877d-9e769b28069e","year":2025},"citing_paper":{"arxiv_id":"2606.25450","last_updated":"2026-06-25T16:37:45Z","snapshot_observed_at":"2026-08-02T04:58:05.165698Z","submitted_at":"2026-06-24T06:26:02Z","title":"The Generalization Spectrum: A Chromatographic Approach to Evaluating Learning Algorithms","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T05:29:21.598397Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2606.25450"},"observation_digest":"sha256:e5128964ccaf9a96016eb21cce7eb5e7c800e09c1eaab3ec48d03c1cce6cbfcb","observation_id":"bd2963ac-e7f9-48ac-87c3-d0e5e4c56045","resolution":{"observed_at":"2026-07-04T13:09:50.545490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"cited_work":{"arxiv_id":"2505.21297","doi":"10.48550/arxiv.2505.21297","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"rstar-coder: Scaling competitive code reasoning with a large-scale verified dataset","venue":"ArXiv.org","work_id":"5a295f3e-abb9-4b86-877d-9e769b28069e","year":2025},"citing_paper":{"arxiv_id":"2606.27369","last_updated":"2026-06-25T17:59:36Z","snapshot_observed_at":"2026-08-03T05:17:54.539513Z","submitted_at":"2026-06-25T17:59:36Z","title":"Reinforcement Learning without Ground-Truth Solutions can Improve LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-26T04:47:47.691913Z"},"links":{"cited_paper":"/paper/2505.21297","citing_paper":"/paper/2606.27369"},"observation_digest":"sha256:2ec9e539be6ac0bdf13b14c5f42f9e1cf3711918472ada0938bb42bd4cdc6e4b","observation_id":"9b77a0bf-18db-4068-aff5-9f5d4053c4b0","resolution":{"observed_at":"2026-07-04T13:59:51.922229Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21297/citation-record","integrity":"/paper/2505.21297/integrity","json":"/paper/2505.21297/citation-record.json","paper":"/paper/2505.21297"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.21318","last_updated":"2025-04-30T05:05:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-30T05:05:09Z","title":"Phi-4-reasoning Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21318","snapshot_observed_at":"2026-08-07T13:40:16.083583Z","title":"Phi-4- reasoning technical report.arXiv preprint arXiv:2504.21318, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:16.083583Z"},"links":{"cited_paper":"/paper/2504.21318","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:429a2e63e46376491739ce47db8510a74b3560873d0e3d6ab648d8c57947650a","observation_id":"fcc68b24-1561-4ac4-b07e-7b6a1fe0f0d2","resolution":{"observed_at":"2026-08-07T13:40:16.083583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01943","last_updated":"2025-08-07T23:04:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-02T17:50:31Z","title":"OpenCodeReasoning: Advancing Data Distillation for Competitive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01943","snapshot_observed_at":"2026-08-07T13:40:16.181554Z","title":"Opencodereasoning: Advancing data distillation for competitive coding.arXiv preprint arXiv:2504.01943, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:16.181554Z"},"links":{"cited_paper":"/paper/2504.01943","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:bb595284a47e7b830830bd6ee32919c81a71380d9ac536fd911b104c2b7c3500","observation_id":"4b654619-c3fc-4ca8-a09e-152c3eac864c","resolution":{"observed_at":"2026-08-07T13:40:16.181554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:16.273875Z","title":"Program synthesis with large language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:16.273875Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:3105b7c4cf032b3514650cff866ce226519c992464d8a7cf86f63ddad6b5475c","observation_id":"26338d3b-3d9e-4ec8-b43e-38129ae7965f","resolution":{"observed_at":"2026-08-07T13:40:16.273875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:23.032791Z","title":"Code alpaca: An instruction-following llama model for code generation","venue":null,"work_id":"13dc55a2-934f-4d5d-b206-f0ac6a69d167","year":2023},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:16.420784Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:5ac158e26e5eb9c904e13be3dcafbfdabf3f749b122ad7e5814dedfc944cf65f","observation_id":"40eb8e2b-d5c5-46a3-8548-6d6af9ba9737","resolution":{"observed_at":"2026-08-07T13:40:23.075969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.10397","last_updated":"2022-11-23T07:42:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-21T10:18:37Z","title":"CodeT: Code Generation with Generated Tests","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.10397","snapshot_observed_at":"2026-08-07T13:40:16.588843Z","title":"Codet: Code generation with generated tests.arXiv preprint arXiv:2207.10397, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:16.588843Z"},"links":{"cited_paper":"/paper/2207.10397","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:525e5575bcab51bc4835897aa6fc3773a35235a751d63098ad643804eb12120c","observation_id":"dcc02d33-6bc9-463e-acc3-d2bf5cd08cc4","resolution":{"observed_at":"2026-08-07T13:40:16.588843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:22.889092Z","title":null,"venue":null,"work_id":"bdd28fd3-69c9-43e1-b42a-e90c3912f3c2","year":2021},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:16.693370Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:b0af09618bc4c25274fe6027c139543809b09a6c9f5498e752459e55769dd8be","observation_id":"a3f36bcf-01a8-458c-a4f2-f92f3253823f","resolution":{"observed_at":"2026-08-07T13:40:22.954751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:16.780708Z","title":"FlashAttention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:16.780708Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:8d2644258a8551e9cc5a2f54106c3be29305ca4a04bba21878fb973fdef1f44b","observation_id":"01e5abcf-7b53-4efd-a508-64168cc282e1","resolution":{"observed_at":"2026-08-07T13:40:16.780708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04519","last_updated":"2025-01-08T14:12:57Z","snapshot_observed_at":"2026-08-04T20:57:22.329262Z","submitted_at":"2025-01-08T14:12:57Z","title":"rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04519","snapshot_observed_at":"2026-08-07T13:40:16.872558Z","title":"rstar-math: Small llms can master math reasoning with self-evolved deep thinking.arXiv preprint arXiv:2501.04519, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:16.872558Z"},"links":{"cited_paper":"/paper/2501.04519","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:c86ce52053991cb22c21f683bff3622537039af3a8da8f69f94fc57611d7e1b3","observation_id":"6db72fc4-c218-4d06-a80d-91872720b3d0","resolution":{"observed_at":"2026-08-07T13:40:16.872558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T13:40:16.962324Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:16.962324Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:57c35dcd308955a25ea399c42e752ff5e274ff17768fcd9993749300a586a2da","observation_id":"20a40a32-c38a-4936-8984-0894f7044d2f","resolution":{"observed_at":"2026-08-07T13:40:16.962324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.09938","last_updated":"2021-11-08T21:16:44Z","snapshot_observed_at":"2026-08-04T23:13:25.514661Z","submitted_at":"2021-05-20T17:58:42Z","title":"Measuring Coding Challenge Competence With APPS","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.09938","snapshot_observed_at":"2026-08-07T13:40:17.007441Z","title":"Measuring coding challenge competence with apps.arXiv preprint arXiv:2105.09938, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:17.007441Z"},"links":{"cited_paper":"/paper/2105.09938","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:dc122165a068d6578d1d23d3a796b83dc34fe51d6cb6638d44ef2b35a93b6b77","observation_id":"461327ea-3794-4e9d-882a-15b77eef2ef7","resolution":{"observed_at":"2026-08-07T13:40:17.007441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17272","last_updated":"2024-07-02T05:02:02Z","snapshot_observed_at":"2026-07-06T16:25:29.858870Z","submitted_at":"2023-09-29T14:23:26Z","title":"Enhancing Large Language Models in Coding Through Multi-Perspective Self-Consistency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17272","snapshot_observed_at":"2026-08-07T13:40:17.057331Z","title":"Enhancing large language models in coding through multi-perspective self-consistency.arXiv preprint arXiv:2309.17272, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:17.057331Z"},"links":{"cited_paper":"/paper/2309.17272","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:eec953fe00dda42b9c80a70a2c5757b7bc112631159f5a1d751a76f52f119d89","observation_id":"6861a483-2a64-4ca9-8b22-1281f01a01ca","resolution":{"observed_at":"2026-08-07T13:40:17.057331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04905","last_updated":"2025-03-20T03:28:56Z","snapshot_observed_at":"2026-08-06T15:51:42.964586Z","submitted_at":"2024-11-07T17:47:25Z","title":"OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04905","snapshot_observed_at":"2026-08-07T13:40:17.124812Z","title":"Opencoder: The open cookbook for top-tier code large language models.arXiv preprint arXiv:2411.04905, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:17.124812Z"},"links":{"cited_paper":"/paper/2411.04905","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:30cbe051c0ca6aaa561f0920985573f0e3987674131ed1f0f76368b5d65e217d","observation_id":"896ecf03-ea14-42c8-8b3a-b53fe11ec73a","resolution":{"observed_at":"2026-08-07T13:40:17.124812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02333","last_updated":"2024-05-08T01:48:46Z","snapshot_observed_at":"2026-07-06T17:39:24.823145Z","submitted_at":"2024-03-04T18:58:30Z","title":"Key-Point-Driven Data Synthesis with its Enhancement on Mathematical Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02333","snapshot_observed_at":"2026-08-07T13:40:17.228117Z","title":"Key-point-driven data synthesis with its enhancement on mathematical reasoning.arXiv preprint arXiv:2403.02333, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:17.228117Z"},"links":{"cited_paper":"/paper/2403.02333","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:faaa055473429636b0a5748e80705abe8851b85bbb3f691a3ce3213d2ea0c9a1","observation_id":"056d6f3b-8055-457c-9cb0-12be14510874","resolution":{"observed_at":"2026-08-07T13:40:17.228117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:22.743468Z","title":"Codeforces-python-submissions","venue":null,"work_id":"d240e433-7de9-403e-a3b8-5c4ac5343096","year":null},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:17.301866Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:7c9cdbb3f7b51c14ff0b29f9d60d421456f18c7e332cda9c272a7a1eaf831dc9","observation_id":"b10d1232-dd91-4e6b-9ede-17f4cd5bdf76","resolution":{"observed_at":"2026-08-07T13:40:22.793850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:22.605657Z","title":null,"venue":null,"work_id":"2fd42109-6488-4e94-ad2d-f6776c0c1772","year":null},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:17.367939Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:c74c0c57647ec60327656c7994f26b9d9d4cc73f735ae040a9f2fdf0f9fb6f72","observation_id":"3e0b267f-daae-4249-a568-39a2eee0b95d","resolution":{"observed_at":"2026-08-07T13:40:22.651138Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:22.436731Z","title":"Qwen2.5-coder technical report","venue":null,"work_id":"7b9427f0-e164-422f-af24-445ce17c448c","year":2024},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:17.476499Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:496aa816989ab3acd01eaadb9533aaa7c1550ffb40c66cc9f73c357b8e757cb0","observation_id":"c3526c4b-b142-40e9-bee4-0f7b54e4c4ae","resolution":{"observed_at":"2026-08-07T13:40:22.523092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T13:40:17.594742Z","title":"Openai o1 system card.arXiv preprint arXiv:2412.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:17.594742Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:89474671bfdef2497227398c53e6ba4c961b1370e0a59ae9575a7ff2147ec9d2","observation_id":"702dc0d1-bde7-44e2-8e8c-342a683f50a7","resolution":{"observed_at":"2026-08-07T13:40:17.594742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-07T13:40:17.736001Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code.arXiv preprint arXiv:2403.07974, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:17.736001Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:f29d05a30feba16ce0d2851fd738f537f1928783099a9c1c205415733d29e561","observation_id":"4cbdfd91-9453-465a-b1eb-a1be50dc5810","resolution":{"observed_at":"2026-08-07T13:40:17.736001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:22.304750Z","title":"Numina- math","venue":null,"work_id":"cb97b583-c0bd-4ede-9101-65b74614d827","year":2024},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:17.918113Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:b0b7a13ab8950246b7d1974d446ba0390d95cc871fcf200477bcfdb803eb3d26","observation_id":"92ad93bd-bd2c-4310-bc20-818a503a8e99","resolution":{"observed_at":"2026-08-07T13:40:22.348907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14852","last_updated":"2023-12-27T10:09:18Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:25:42Z","title":"TACO: Topics in Algorithmic COde generation dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14852","snapshot_observed_at":"2026-08-07T13:40:18.118291Z","title":"Taco: Topics in algorithmic code generation dataset.arXiv preprint arXiv:2312.14852, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:18.118291Z"},"links":{"cited_paper":"/paper/2312.14852","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:8027310d0109e4bb517c07169a852013c16d927c99a791de0f1ab15a5149bc24","observation_id":"007173f1-59ce-4784-b6c0-7b843d0f61b5","resolution":{"observed_at":"2026-08-07T13:40:18.118291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:18.298848Z","title":"Competition-level code generation with alphacode.Science, 378(6624):1092–1097, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:18.298848Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:8ddfb036e63a05500f02786beea10c3a227ce19590e66e230029b1bd0dc37372","observation_id":"9ff21bb8-8a55-48bc-b5f8-4f18ac6188cd","resolution":{"observed_at":"2026-08-07T13:40:18.298848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:18.424956Z","title":"Is your code generated by chatGPT really correct? rigorous evaluation of large language models for code generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:18.424956Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:3f57785f53fd4953fed16bc56978a9c7a1d3120d69223ba554dd0f8d010d9fcd","observation_id":"d9308fc5-b406-4e2f-9416-619ac1e6e120","resolution":{"observed_at":"2026-08-07T13:40:18.424956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:22.140982Z","title":"Wizardcoder: Empowering code large language models with evol-instruct","venue":null,"work_id":"f0fbf133-da93-4b39-9a13-6bdff5f1991c","year":2024},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:18.565487Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:f50ea5b7c23dc53cfe4f84b7cbabf9e34e1495cd8e75d06177d1f8f6ac0dd4fb","observation_id":"9fcb0264-1839-4981-b514-7fbe9dbf955a","resolution":{"observed_at":"2026-08-07T13:40:22.201629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:21.990343Z","title":"Deepcoder: A fully open-source 14b coder at o3-mini level","venue":null,"work_id":"995fa42c-6275-4556-a029-0e86423b71ee","year":null},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:18.748133Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:79e5d88585a0cae939502cb93520002d7868fd347eb7907cc30930cfc811e9f3","observation_id":"8532f7c9-5869-4ff1-8120-4cb818ed9824","resolution":{"observed_at":"2026-08-07T13:40:22.064746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:21.875305Z","title":"Open r1: Update 3, 2025","venue":null,"work_id":"b9c39254-45d0-43bb-9b49-cfc291fb499d","year":2025},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:18.905726Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:89c8f4e10bdc5aab3fc9397dcac2ad29d84511ead7d17eadcd19144c7b843e15","observation_id":"f89a8fae-3a69-4044-9611-31b3326241fe","resolution":{"observed_at":"2026-08-07T13:40:21.914808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10952","last_updated":"2024-04-16T23:27:38Z","snapshot_observed_at":"2026-08-07T05:16:48.851507Z","submitted_at":"2024-04-16T23:27:38Z","title":"Can Language Models Solve Olympiad Programming?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10952","snapshot_observed_at":"2026-08-07T13:40:18.998678Z","title":"Can language models solve olympiad programming?arXiv preprint arXiv:2404.10952, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:18.998678Z"},"links":{"cited_paper":"/paper/2404.10952","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:22c352c1c5b70ce6ca42b1c8d9d960918f7ffa2dbf37bea7885f7a8988f4bee9","observation_id":"9ad325d3-e2e5-4c7b-ac24-6edf60c79f32","resolution":{"observed_at":"2026-08-07T13:40:18.998678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:19.131494Z","title":"Open Thoughts","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:19.131494Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:bd313841ef6e5dfc50ad8f3f8746fb1d6e44f81c39c62fbfc64c4fc3e748511a","observation_id":"bd4deb0c-1f62-43f8-af82-e8cd72a7e110","resolution":{"observed_at":"2026-08-07T13:40:19.131494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:19.251139Z","title":"Qwq-32b: Embracing the power of reinforcement learning, March 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:19.251139Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:fb22078f7be03a7348f88fbd29f2b6efb2a8e7c4ea39202a6364752bda0f3226","observation_id":"ff6195a5-ff97-4e90-908c-01f13b277e54","resolution":{"observed_at":"2026-08-07T13:40:19.251139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:19.364811Z","title":"Magicoder: Empow- ering code generation with OSS-instruct","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:19.364811Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:8a59bfc86cb7a9f19d839776abd8dfa55fd44d5823e086f4cd2900cf078fcd94","observation_id":"1f66b985-88b3-44d3-b80d-af466b89e55f","resolution":{"observed_at":"2026-08-07T13:40:19.364811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:19.464965Z","title":"Kodcode: A diverse, challenging, and verifiable synthetic dataset for coding, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:19.464965Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:d70b5a53ec63b414acd57fdfc268018cf2b67ba34a9626d7adf1f9c94fdca99e","observation_id":"35958b2c-b5fa-4e7f-97b5-9387ec3b2d82","resolution":{"observed_at":"2026-08-07T13:40:19.464965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:19.574831Z","title":"Wavecoder: Widespread and versatile enhancement for code large language models by instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:19.574831Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:921c0024b211639ab459ed25de50c74c03599328c5e5cfdc765191aa2add08d4","observation_id":"a7894063-4fc4-4b2e-b2aa-3fd15f9e84d3","resolution":{"observed_at":"2026-08-07T13:40:19.574831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01718","last_updated":"2025-05-24T04:36:48Z","snapshot_observed_at":"2026-07-06T20:30:31.588538Z","submitted_at":"2025-02-03T18:46:04Z","title":"ACECODER: Acing Coder RL via Automated Test-Case Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01718","snapshot_observed_at":"2026-08-07T13:40:19.680813Z","title":"Acecoder: Acing coder rl via automated test-case synthesis.arXiv preprint arXiv:2502.01718, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:19.680813Z"},"links":{"cited_paper":"/paper/2502.01718","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:7ef54eedd548c17322888c9b4b78cccb56bbfa7581b5bae6d0940fb78f16ed37","observation_id":"1d1bf505-893d-4b47-a5fc-ddfbb1fe33c0","resolution":{"observed_at":"2026-08-07T13:40:19.680813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:21.651223Z","title":"Algo: Synthe- sizing algorithmic programs with generated oracle verifiers.Advances in Neural Information Processing Systems, 36:54769–54784, 2023","venue":null,"work_id":"5ac3ff84-a445-4492-8b89-44ed857841c9","year":2023},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:19.727981Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:b2896b92edcaa040a2742420824b7bbfb2e76ecb38002061124466526674313a","observation_id":"a1b05727-e8e1-4fe2-b92d-80136fc2c488","resolution":{"observed_at":"2026-08-07T13:40:21.707926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14286","last_updated":"2025-04-22T10:07:13Z","snapshot_observed_at":"2026-08-07T16:00:56.247889Z","submitted_at":"2025-04-19T13:06:03Z","title":"SRPO: A Cross-Domain Implementation of Large-Scale Reinforcement Learning on LLM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14286","snapshot_observed_at":"2026-08-07T13:40:19.810322Z","title":"846903\"Output:304689 Example 2:Input:s =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:19.810322Z"},"links":{"cited_paper":"/paper/2504.14286","citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:d69c9039e29326d73ecda7103139ae0d8c6f753b565c115719ce366904f7b491","observation_id":"8fa0b0cb-40ff-44f7-9096-c22dd012a6ec","resolution":{"observed_at":"2026-08-07T13:40:19.810322Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:21.482513Z","title":"Identify the reasoning steps (e.g., Step 1, Step 2, Step 3) and summarize the knowledge points tested in the original problem","venue":null,"work_id":"c5de424b-b0e9-4169-aaea-a2a4044c7655","year":null},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:19.902791Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:4ce50629ad5a7b9a16fe09eae84cb86d85baa5227792adfadf037360c607c84b","observation_id":"13034de7-14a4-4813-8a2f-db51802bd916","resolution":{"observed_at":"2026-08-07T13:40:21.537304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:21.287802Z","title":"as in the original problem","venue":null,"work_id":"67d73239-91a7-405c-8d92-f9e0bdf0f3d6","year":null},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:20.004954Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:ddd6a958bf35be23b7e23daa05ad2ba962fa883cf9d1d1e233fa54ddc75727a1","observation_id":"628d8401-4412-4de9-9c83-94ec70d3fc7e","resolution":{"observed_at":"2026-08-07T13:40:21.360221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:21.140391Z","title":null,"venue":null,"work_id":"51ddf1b3-6ef0-44e9-a4ec-da7237f96797","year":null},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:20.110552Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:577af032097b19f891f481d600ab5bf1e629412ef0a6a1675eeb0fa5c4cd79c6","observation_id":"f5f6c11a-9489-41d1-a965-91c29498e444","resolution":{"observed_at":"2026-08-07T13:40:21.226217Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:20.849915Z","title":"The function should validate that the parameters fall within the specified constraints","venue":null,"work_id":"92487692-1329-4e43-901d-b4f6a08ba00f","year":null},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:20.186542Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:983a1f4c9fbb77509602aa79fe82a1fc127a09d032d32719c565f40066bec07e","observation_id":"9cb65650-01cc-4db2-8f4a-8f56e56e1029","resolution":{"observed_at":"2026-08-07T13:40:20.994739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:40:20.692867Z","title":"t e s t _ i n p u t s","venue":null,"work_id":"65529694-ae91-44a3-9f10-a18e65737849","year":null},"citing_paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:40:20.293962Z"},"links":{"citing_paper":"/paper/2505.21297"},"observation_digest":"sha256:266ccf7ab77fe562025faf9a0f838211473949a75f82d0124b2a91d9bd03f404","observation_id":"289d4c91-d9c0-4372-b27f-ae1bddb59ffc","resolution":{"observed_at":"2026-08-07T13:40:20.766559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21297","last_updated":"2025-05-27T15:00:57Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T13:28:17.822753Z","submitted_at":"2025-05-27T15:00:57Z","title":"rStar-Coder: Scaling Competitive Code Reasoning with a Large-Scale Verified Dataset"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":25,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 18 inbound Pith citation observations for arXiv:2505.21297."}