{"as_of":"2026-08-18T15:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:48547750ac93ac3046701b90f41b8cfd80f1906d7a02c48d1f6ed8eb13d59dfe","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T19:34:12.081362Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:37:37.582083Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.26971","snapshot_observed_at":"2026-08-02T06:37:37.582083Z","title":"RLVR datasets and where to find them: Tracing data lineage for better training data","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.12395","last_updated":"2026-07-16T03:43:34Z","snapshot_observed_at":"2026-08-15T14:50:02.087485Z","submitted_at":"2026-07-14T06:14:55Z","title":"Ring-Zero: Scaling Zero RL to a Trillion Parameters for Emergent Reasoning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T06:37:37.582083Z"},"links":{"cited_paper":"/paper/2605.26971","citing_paper":"/paper/2607.12395"},"observation_digest":"sha256:299f9c6bb649856c8a66214600425617457b86a9cca24ca8b423d18ee176408c","observation_id":"9ad04e95-8e2d-4ead-9895-0dbd5ea30dd3","resolution":{"observed_at":"2026-08-02T06:37:37.582083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.26971/citation-record","integrity":"/paper/2605.26971/integrity","json":"/paper/2605.26971/citation-record.json","paper":"/paper/2605.26971"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.17387","last_updated":"2025-02-24T18:14:01Z","snapshot_observed_at":"2026-08-18T07:57:35.968161Z","submitted_at":"2025-02-24T18:14:01Z","title":"Big-Math: A Large-Scale, High-Quality Math Dataset for Reinforcement Learning in Language Models","version":1},"cited_work":{"arxiv_id":"2502.17387","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.17387","snapshot_observed_at":"2026-07-04T16:39:58.415508Z","title":"Big-math: A large-scale, high-quality math dataset for reinforcement learning in language models","venue":null,"work_id":"00edb0c5-3c62-421d-a532-03e2594f1dba","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2502.17387","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:8b887546635a522b762bfc356512888728739152ed1be5fdf191d4bf8f5e44f9","observation_id":"9c301df9-2be6-498b-a8b6-79e6b47f0dc2","resolution":{"observed_at":"2026-06-29T19:43:55.056489Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:476d6548427d08f8f4c6379ba6d8a81dce64b17186156906d8cce2eacedac4b5","observation_id":"e1e76676-cffa-4000-be15-5c514ac7b13d","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.26768","doi":"10.48550/arxiv.2510.26768","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2510.26768 , year=","venue":"arXiv (Cornell University)","work_id":"c293420a-3806-46e9-98bc-1d7f3259b246","year":2026},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:91562083175d06e116ea24ffa76ba8be902f78f2dce70e3cc0280878a4a59447","observation_id":"cbd14c82-53fa-41e9-881c-c4b990171250","resolution":{"observed_at":"2026-06-29T19:43:55.062918Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:3d9a3e9899c5bcf36f20a3876589657f928801f69d3fa4400de242c7b7df4f3a","observation_id":"69d361b4-1f68-4b74-a5f3-c3e7cbbc8b83","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16400","last_updated":"2025-06-05T17:59:12Z","snapshot_observed_at":"2026-08-17T12:06:20.372156Z","submitted_at":"2025-05-22T08:50:47Z","title":"AceReason-Nemotron: Advancing Math and Code Reasoning through Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2505.16400","doi":"10.48550/arxiv.2505.16400","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Acereason-nemotron: Advancing math and code reasoning through reinforcement learning","venue":"ArXiv.org","work_id":"428ad314-c120-41da-9db7-b8bc1918fffb","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2505.16400","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:bd56385c853b6a1125283fd01d551f6b21754c27287f210e14b7261c0547b820","observation_id":"49c626dd-add2-429b-a250-05b5da73c1f4","resolution":{"observed_at":"2026-06-29T19:43:55.053657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04548","last_updated":"2025-03-06T15:34:27Z","snapshot_observed_at":"2026-08-16T12:52:27.817776Z","submitted_at":"2025-03-06T15:34:27Z","title":"An Empirical Study on Eliciting and Improving R1-like Reasoning Models","version":1},"cited_work":{"arxiv_id":"2503.04548","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.04548","snapshot_observed_at":"2026-07-03T04:27:36.567324Z","title":"An empirical study on eliciting and improving r1-like reasoning models","venue":null,"work_id":"5d962724-fdfd-471c-b457-0c9fd4d5aa44","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2503.04548","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:c9338395604b874f3fddc8373d6c467aac26a4fcbb7d4bd0c266f24bd7108aea","observation_id":"9a52c77f-62d9-4e31-bdcd-bf21981882e7","resolution":{"observed_at":"2026-06-29T19:43:55.066083Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14425","last_updated":"2025-06-05T00:49:05Z","snapshot_observed_at":"2026-08-16T12:56:44.035834Z","submitted_at":"2025-02-20T10:23:27Z","title":"A Survey on Data Contamination for Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.14425","doi":"10.48550/arxiv.2502.14425","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.14425 , year=","venue":"ArXiv.org","work_id":"93c324c7-c726-4b33-a231-2ee7f4fb0fab","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2502.14425","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:159d2aaf54669e8214d3b59aad26cb937e5625341e880978ff18d282210b355b","observation_id":"097da742-b62e-445f-9461-18e7f716481f","resolution":{"observed_at":"2026-06-29T19:43:55.059768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:da76301be2f52b66456bc7c9a0381a9d5a2b821bb8f1a2ed8c9f13825ad0d1d9","observation_id":"b14226d1-b1c6-4322-af49-8edaa9107a0b","resolution":{"observed_at":"2026-06-29T19:43:55.117557Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-08-17T04:59:59.434643Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":"2502.01456","doi":"10.48550/arxiv.2502.01456","metadata_source":"pith","pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Process Reinforcement through Implicit Rewards","venue":"cs.LG","work_id":"c31a2126-86f9-44f3-91f3-208d0fc1463a","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:dd453e271e0cf079de0841c664d7351fb99a57750f9d55d4dc9726b024a86191","observation_id":"f7c99ed8-a1e3-44d1-b778-03fc00a6e4ad","resolution":{"observed_at":"2026-06-29T19:43:55.124047Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-07T20:38:24.357487+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T20:38:24.357487+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41597-025-05283-3","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.1038/s41597-025-05283-3 , url =","venue":"Scientific Data","work_id":"fc24a3fb-7e30-446c-838e-99e99499f28b","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:469225dc1d2a5818fcb003859e1eb828ae2fe8c05b2288493a2d98faa3a30f0c","observation_id":"f0634f3b-fd28-4944-878f-4254a5171838","resolution":{"observed_at":"2026-06-29T19:43:54.509592Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:52:24.245795+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:52:24.245795+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-naacl.291","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"60484996-468c-4066-b32c-57be7900fcf5","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:205912767a30d3c9a715325614455b227165bbccb14da1cf1001fb5ce7910880","observation_id":"3b5bab0e-87c1-4609-a574-5ed08c4132c3","resolution":{"observed_at":"2026-06-29T19:43:54.514258Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07985","last_updated":"2024-12-24T04:04:30Z","snapshot_observed_at":"2026-08-16T19:47:24.627230Z","submitted_at":"2024-10-10T14:39:33Z","title":"Omni-MATH: A Universal Olympiad Level Mathematic Benchmark For Large Language Models","version":3},"cited_work":{"arxiv_id":"2410.07985","doi":"10.48550/arxiv.2410.07985","metadata_source":"pith","pith_arxiv_id":"2410.07985","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Omni-MATH: A Universal Olympiad Level Mathematic Benchmark For Large Language Models","venue":"cs.CL","work_id":"8c4a2a23-9139-4a53-84de-60b6f027ae02","year":2024},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2410.07985","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:334fbecce5737511fc0207076fece31dbae1436f6bf46d43080acaafb59d0c17","observation_id":"90451569-2903-46be-946b-89165f4f4bdc","resolution":{"observed_at":"2026-06-29T19:43:55.098336Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:c7d2a0bf081cb1aac1ebb05ee2e50e98b8278d169723e0f6c8d88305a560e377","observation_id":"3c63c3d9-568d-4062-b753-66305764c717","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14008","last_updated":"2024-06-06T13:19:44Z","snapshot_observed_at":"2026-08-03T03:39:09.398343Z","submitted_at":"2024-02-21T18:49:26Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","version":2},"cited_work":{"arxiv_id":"2402.14008","doi":"10.48550/arxiv.2402.14008","metadata_source":"pith","pith_arxiv_id":"2402.14008","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","venue":"cs.CL","work_id":"19abed3b-0ff6-409b-aded-a50205319aa3","year":2024},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2402.14008","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:87818298d54b7392cfd238685028cbf4fe7ccb608a38a2c894b37388d8793c71","observation_id":"03f72992-20c9-4fe6-8271-916480fdc354","resolution":{"observed_at":"2026-06-29T19:43:55.080471Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22312","last_updated":"2025-05-29T09:07:33Z","snapshot_observed_at":"2026-08-15T23:24:42.542733Z","submitted_at":"2025-05-28T12:56:04Z","title":"Skywork Open Reasoner 1 Technical Report","version":2},"cited_work":{"arxiv_id":"2505.22312","doi":"10.48550/arxiv.2505.22312","metadata_source":"pith","pith_arxiv_id":"2505.22312","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Skywork Open Reasoner 1 Technical Report","venue":"cs.LG","work_id":"27740ebb-6704-4ef9-8878-5b81d4269869","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2505.22312","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:79dd4324ba664062ee1aad9e8214f28bb3198c25fac03fbdb88a4ad400c60dff","observation_id":"d235309d-522d-4a9f-a5c2-746587fc5935","resolution":{"observed_at":"2026-06-29T19:43:55.104714Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11456","last_updated":"2025-05-22T19:12:14Z","snapshot_observed_at":"2026-08-13T20:36:12.184426Z","submitted_at":"2025-04-15T17:59:51Z","title":"DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning","version":2},"cited_work":{"arxiv_id":"2504.11456","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.11456","snapshot_observed_at":"2026-07-09T03:25:57.840663Z","title":"DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning","venue":"cs.CL","work_id":"3dea79f1-73da-4db2-8d7b-64013c3c5fa5","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2504.11456","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:1621fd349ee0eb4930e6fdb06ac8221272c14ac3ecbfc63a3c9217e88212cdb0","observation_id":"bda730de-94b9-4c7c-8f93-9450c7624124","resolution":{"observed_at":"2026-06-29T19:43:55.115046Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":"2103.03874","doi":"10.48550/arxiv.2103.03874","metadata_source":"pith","pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":"cs.LG","work_id":"50652ac6-fb7c-4675-a2c2-159c241feb17","year":2021},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:f7eaeac3831dd4b95374cf86925aa05e82f049c4f29e6a8d789634fd681fd455","observation_id":"b48cbc83-1080-4b71-8c47-82094e2c52e8","resolution":{"observed_at":"2026-06-29T19:43:55.131638Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.14311","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:43:55.095406Z","title":"Tracing the Data Trail: A Survey of Data Provenance, Transparency and Traceability in LLMs","venue":null,"work_id":"ba661eed-deab-4a42-8021-0a273b41cbbe","year":2026},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:81380e7559385c062db6635f3e8b9e5988d22673c75dd9c53133813c9a2aaf02","observation_id":"df54c5d9-60ec-45e6-bf4e-682445dbf2d8","resolution":{"observed_at":"2026-06-29T19:43:55.097004Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24290","last_updated":"2025-07-05T09:01:04Z","snapshot_observed_at":"2026-08-12T18:49:18.486177Z","submitted_at":"2025-03-31T16:36:05Z","title":"Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model","version":2},"cited_work":{"arxiv_id":"2503.24290","doi":"10.48550/arxiv.2503.24290","metadata_source":"pith","pith_arxiv_id":"2503.24290","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model","venue":"cs.LG","work_id":"763e0e44-40dd-4bdd-8414-21f8f9ce6d10","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2503.24290","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:c0c64a63538ef1e86bf22af92bd114dadee1fa6967b0d5bbbfcb8a25860b3508","observation_id":"d2bec7f2-c0bd-467d-8122-813184c579b3","resolution":{"observed_at":"2026-06-29T19:43:55.103705Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.19281","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:49:52.427565Z","title":"W., and Zhao, H","venue":null,"work_id":"b453d49a-b915-4c71-892b-d8e2abc9f19b","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:64e25931d3c280e8675952ffd4982a3a6b805f5b6d9ac7aeae9f308f91217d43","observation_id":"bd0ecbbd-e9c8-497f-9fa5-5ce420c44a5e","resolution":{"observed_at":"2026-06-29T19:43:55.109420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:7eb02d0e5240134634764dc87b502a6933b4db58651da36c599279dcb241a592","observation_id":"59213391-0bbb-4056-9b7a-17b88b1e24f3","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.04730","last_updated":"2020-12-29T22:40:43Z","snapshot_observed_at":"2026-08-15T02:28:36.697260Z","submitted_at":"2017-03-14T21:07:01Z","title":"Understanding Black-box Predictions via Influence Functions","version":3},"cited_work":{"arxiv_id":"1703.04730","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1703.04730","snapshot_observed_at":"2026-07-04T06:19:38.882684Z","title":"arXiv:1703.04730 [cs, stat] , author =","venue":null,"work_id":"c60d6497-3724-4a3c-99e9-b230c013d45b","year":2020},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/1703.04730","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:e8ec19d8b2a4c3142cabd22f7bb92b604088a1c1fe0cd6d234abaa3817abefa8","observation_id":"f33a1bdb-f920-446f-9488-d82e1e082285","resolution":{"observed_at":"2026-06-29T19:43:55.126095Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:7ec4abfc51d4b7e3b8aa097b08ff443818ebd984908ef62952e8952a0d3eaf6f","observation_id":"4b584663-ed5e-466b-8cb6-da223426e6e9","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:4d447ffa5931d6422822320525a154c246ad2f620ee16970db14eed1f8ed3e3d","observation_id":"30a49a12-97c7-4133-9c6e-11a9a171ed6d","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:a82de8b334d2eabd134f21bd928fe4c76f744c5ab984bebad3d5ade7755fae13","observation_id":"0b4589fe-d001-4332-8cf5-9a463a89a83b","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.1794","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards Robust Mathematical Reasoning","venue":null,"work_id":"da5c2222-6fc3-4c88-8175-a1b1d83743ad","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:a48af5b21cf700e8c7ff0425ffef08d43976d634ea3d51c46b4b3f09a4be18ca","observation_id":"c19f5d1d-9d06-40b4-82c6-571b5a493b97","resolution":{"observed_at":"2026-06-29T19:43:54.516248Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-25T15:23:56.464287+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T15:23:56.464287+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09413","last_updated":"2024-12-22T10:44:13Z","snapshot_observed_at":"2026-08-16T16:04:15.848709Z","submitted_at":"2024-12-12T16:20:36Z","title":"Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems","version":2},"cited_work":{"arxiv_id":"2412.09413","doi":"10.48550/arxiv.2412.09413","metadata_source":"pith","pith_arxiv_id":"2412.09413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems","venue":"cs.AI","work_id":"c917c167-9618-4111-9a7c-fb60c4fc7795","year":2024},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2412.09413","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:ef59f330d7dab9c40b260c2c3378700f6e6653d1c64bed5a17cb200932b52d24","observation_id":"6a874e6d-c776-4551-b065-c41e72b19586","resolution":{"observed_at":"2026-06-29T19:43:55.128797Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.emnlp-main.392","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mishra, M","venue":null,"work_id":"3a00ca17-b63e-41fc-a851-1efd0f68d966","year":2022},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:147c31a554e0933e61d628cfc95261d42f592a9b31f8ce94bc28f672545c392c","observation_id":"89b2c1e2-750b-4efa-8560-bb3e51fc2c28","resolution":{"observed_at":"2026-06-29T19:43:54.518419Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:52:33.275809+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:52:33.275809+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:a412194782419c90af5460d791c49c9aa017ef5e988d4a9f4aad7ac6bf55c50c","observation_id":"0d60b462-749e-4d43-918d-3fb9db3d3a21","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14249","last_updated":"2026-02-20T04:23:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-24T05:27:46Z","title":"Humanity's Last Exam","version":10},"cited_work":{"arxiv_id":"2501.14249","doi":"10.1038/s41586-025-09962-4","metadata_source":"pith","pith_arxiv_id":"2501.14249","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Humanity's Last Exam","venue":"cs.LG","work_id":"59ea00d4-16a8-45e1-aafc-290a6f91d9f4","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2501.14249","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:fd2420c0ac96887d840444bf922885b7cea27344a031c170a38b7a84e43c4c8d","observation_id":"dde0168a-b5c0-48f3-ac27-b2e65cd62f20","resolution":{"observed_at":"2026-06-29T19:43:54.507390Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-03T22:08:32.844211+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T22:08:32.844211+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.03986","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T13:46:59.065029Z","title":"Benchmarkˆ 2: Systematic evaluation of llm benchmarks.arXiv preprint arXiv:2601.03986, 2026","venue":null,"work_id":"ee7be274-e295-430b-87e4-515e3427eee1","year":2026},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:4c60013b787a218483c2904b2133a701d74b964100d61f18a36d24a810520ca3","observation_id":"8b461ad2-ede9-45a6-8575-56c18463991e","resolution":{"observed_at":"2026-06-29T19:43:55.074322Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-1410","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:56:41.012481Z","title":"Sentence- BERT : Sentence Embeddings using S iamese BERT -Networks","venue":"Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing and the 9th International Joint Conference on Natural Language Processing (EMNLP-IJCNLP)","work_id":"cf07889b-1f35-4d81-9514-4ad3ed223c57","year":2019},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:402d73246f8e6bb63a6ee76f924ff24bf291e28fbf0d8343ce3227596bf87dcc","observation_id":"a2a7ffaf-2eba-4ecf-9d88-e05d3d1796fc","resolution":{"observed_at":"2026-06-29T19:43:54.510303Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-14T23:08:17.316518+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-14T23:08:17.316518+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-18T14:12:03.598270Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":"2311.12022","doi":"10.48550/arxiv.2311.12022","metadata_source":"pith","pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","venue":"cs.AI","work_id":"9e2a976b-f5ad-4aee-af5c-243fe0fe75d2","year":2023},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:237a49fd9cc80e594bbafdcac2cda1d7674757d1cabc92d9422cee9c1c31b135","observation_id":"0d962726-48b5-4809-a5bd-f947e643a5be","resolution":{"observed_at":"2026-06-29T19:43:55.112001Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.941438+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.941438+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.13914","doi":"10.48550/arxiv.2504.13914","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Seed1.5-thinking: Advancing superb reasoning models with reinforce- ment learning","venue":"ArXiv.org","work_id":"1eaca2b2-5ee7-4243-b8f5-117441248181","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:276723d1fcc3e01f97d9b40f3265c1087ede23f6d321d02b8ae85408425579e4","observation_id":"b11690b0-b845-4a39-8f38-d0f8128d33e2","resolution":{"observed_at":"2026-06-29T19:43:55.120369Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:3725d72ceed2db62181d147fee3c1d1bc9363fb775b4b09369b618dfcdc3f1f8","observation_id":"9f38b19c-5c8e-4a38-89b7-64a049a26792","resolution":{"observed_at":"2026-06-29T19:43:55.134111Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9031.369607","doi":"10.1145/3689031.3696072","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":"4909736c-3fe1-4820-b489-cca51669c6d2","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:20d5d2e1479935f533aeae5d9a9013cd51f63df9e39cffc938345178ddca59e3","observation_id":"ec4a8897-c182-41f8-a878-985d278cdb3e","resolution":{"observed_at":"2026-06-29T19:43:54.512519Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.07629","doi":"10.48550/arxiv.2508.07629","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Klear-reasoner: Advancing reasoning capability via gradient-preserving clipping policy optimization.arXiv preprint arXiv:2508.07629","venue":"ArXiv.org","work_id":"2d3fe64a-7a53-4e46-b832-c2a7bb443af1","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:055cc5b6aa26fece6f45c5e057515f9c3ff2aa4018b3b1dff27dc8d81ad08d0e","observation_id":"9e8dde8c-8de6-4028-80cc-1b97bf45642a","resolution":{"observed_at":"2026-06-29T19:43:55.110160Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14945","last_updated":"2025-06-22T00:18:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-21T08:09:13Z","title":"Learning to Reason under Off-Policy Guidance","version":5},"cited_work":{"arxiv_id":"2504.14945","doi":"10.48550/arxiv.2504.14945","metadata_source":"pith","pith_arxiv_id":"2504.14945","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to Reason under Off-Policy Guidance","venue":"cs.LG","work_id":"4ebcdbe2-5000-4f58-a7e0-aa9ae381b684","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2504.14945","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:b079358cb6b31fe2f47a5e6b4270935cd682042b1e8e9344c2c1a313ad17ad01","observation_id":"ecf3c5a1-0cbe-404d-9d31-2eb0b3c3c106","resolution":{"observed_at":"2026-06-29T19:43:55.120653Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:93521ad26fe2afdecd0fb7abae313ed15e7f83a7eeb3e17dd400d0207c85f56e","observation_id":"ba46adc2-c25a-4767-b0f6-351df31c2956","resolution":{"observed_at":"2026-06-29T19:43:55.115832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-18T05:01:20.543826Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:53baa47309f2606edeed9f4c90b8e2a1f19ad78c1d384dabfb05cbb247911aaa","observation_id":"e81184e6-0e27-4f75-b065-25ff975000b2","resolution":{"observed_at":"2026-06-29T19:43:55.118299Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:20.547492+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:20.547492+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08819","last_updated":"2024-12-11T23:31:06Z","snapshot_observed_at":"2026-08-18T08:24:01.522950Z","submitted_at":"2024-12-11T23:31:06Z","title":"HARP: A challenging human-annotated math reasoning benchmark","version":1},"cited_work":{"arxiv_id":"2412.08819","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.08819","snapshot_observed_at":"2026-07-02T03:46:32.285662Z","title":"Harp: A challenging human-annotated math reasoning benchmark","venue":null,"work_id":"8a3a77a2-446d-4556-a6f9-9e59b52a5697","year":2024},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"cited_paper":"/paper/2412.08819","citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:c4131f05b25459a2a2a71effa85983e386d6c6566a38099797b1763512e04afc","observation_id":"eff1eb27-23a6-46d0-9ba9-939084390f85","resolution":{"observed_at":"2026-06-29T19:43:55.081562Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:466a1f013eb7c5eab3feeaca5f8e51e8ddcb73ed6443ba890b2e0a8f270ec9f9","observation_id":"64da264a-5083-46ff-8af4-22ddceb80957","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:5a469b8ed06fca7d07667d5f6ae15da22ef4a6f64bc84798a4ba4e7267481efa","observation_id":"91808bf8-de04-4107-848b-5e303b475cfc","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:29f46adf89a58677668fd2bf3f283f9ba951d38b8d41040f1921c5c298285753","observation_id":"31bbc549-ee2b-4d4f-9cf9-5c92446fe787","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.01907","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T22:06:17.121188Z","title":"Efficient rlvr training via weighted mutual information data selection.arXiv preprint arXiv:2603.01907","venue":null,"work_id":"dcd370ac-aec9-4523-809f-89baef8802d0","year":2026},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:24fb4267599659b9802775111c1ef092766c131e9a6743b91439946b1ede1531","observation_id":"e75c961e-c7d7-4041-8440-c210687d1fdb","resolution":{"observed_at":"2026-06-29T19:43:55.094209Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.11674","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:43:55.111474Z","title":null,"venue":null,"work_id":"9fe3abea-08b4-451e-adc4-88371da7ad48","year":2026},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:d98bea8b84cb3d88083a7bf6855acb4a6f307f08e9cec8a69f08f44d15473589","observation_id":"fa0f079d-2285-4e19-b267-487a32c98cc4","resolution":{"observed_at":"2026-06-29T19:43:55.112838Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:f987bba82f4d1c6e4929c304ce6ec941d0af0b2a44c33f1a3c6c3b550f1aae47","observation_id":"2e0316f1-fc00-4066-b959-9e8e9152da15","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T19:34:12.081362Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-29T19:34:12.081362Z"},"links":{"citing_paper":"/paper/2605.26971"},"observation_digest":"sha256:068067e00af8743b83becc6555bfc2c1f87392a53e1982b5fc989d0ea9329d43","observation_id":"491c1d1d-4f2f-4f43-80e8-b622c48de2e7","resolution":{"observed_at":"2026-06-29T19:34:12.081362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.26971","last_updated":"2026-05-26T12:57:12Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T18:23:52.993798Z","submitted_at":"2026-05-26T12:57:12Z","title":"RLVR Datasets and Where to Find Them: Tracing Data Lineage for Better Training Data"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":13,"verified_exact":33,"verified_fuzzy":0},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2605.26971."}