{"as_of":"2026-08-07T08:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea5d9408a19a79be5f74b6e4eb7c318265993251e5c66919f355886793cc834c","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T08:39:54.747656Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.06499/citation-record","integrity":"/paper/2510.06499/integrity","json":"/paper/2510.06499/citation-record.json","paper":"/paper/2510.06499"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mmlu-pro: A more robust and challenging multi-task language under- standing benchmark","venue":null,"work_id":"24f96837-01f1-4594-afa2-7dd69b737dad","year":2024},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:e8c746310162263dde612764e0e337e311bee49b02d8b8784ac7e0e151d50bad","observation_id":"73657560-8860-486f-b566-08c91ad64deb","resolution":{"observed_at":"2026-05-18T08:41:09.350053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Redpajama: an open dataset for training large language models","venue":null,"work_id":"610441f5-e995-4066-ac37-8b4507ed99f6","year":2024},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:0fb5b634a9d2964fd5225c3c3bec7232be8e5618dfc52716f373c456715aa109","observation_id":"4843b6e9-6fb5-4766-9fb6-83d60f140e3b","resolution":{"observed_at":"2026-05-18T08:41:09.353492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18449","last_updated":"2025-12-01T00:16:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-25T18:45:04Z","title":"SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution","version":2},"cited_work":{"arxiv_id":"2502.18449","doi":"10.48550/arxiv.2502.18449","metadata_source":"pith","pith_arxiv_id":"2502.18449","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution","venue":"cs.SE","work_id":"4b93fb93-87c9-40fe-84d0-d7ecb4e11bed","year":2025},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"cited_paper":"/paper/2502.18449","citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:0765412df068e75cfeaec13fd5adbc3f9bce27e11032919ea48af26abaa3d0e8","observation_id":"3d078f5f-a8a0-4351-aadb-4ad72df21172","resolution":{"observed_at":"2026-05-18T08:41:08.353287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09739","last_updated":"2024-07-17T20:50:11Z","snapshot_observed_at":"2026-07-06T17:30:25.359458Z","submitted_at":"2024-02-15T06:36:07Z","title":"QuRating: Selecting High-Quality Data for Training Language Models","version":3},"cited_work":{"arxiv_id":"2402.09739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.09739","snapshot_observed_at":"2026-07-03T19:18:54.736613Z","title":"arXiv preprint arXiv:2402.09739 , year=","venue":null,"work_id":"00074fdb-f90b-47dd-9baf-a608823f0343","year":2024},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"cited_paper":"/paper/2402.09739","citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:b2f688d4c7d741c209b2540a070f46c37d5cf03d6b54f1377b5da43a3180e0de","observation_id":"d20d0a03-a512-4361-babe-7be14fa90ff2","resolution":{"observed_at":"2026-05-18T08:41:08.344219Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"[Online]","venue":null,"work_id":"7034b12f-d444-4928-8322-7eff613be3ed","year":2025},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:2ab126406aef3c864e856c5724ac44824f4b4662a8d02c0194f3b88b3a20f007","observation_id":"0bb9845d-73aa-4314-a9ec-3e8cadbf3b4f","resolution":{"observed_at":"2026-05-18T08:41:09.345872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14768","last_updated":"2025-02-20T17:49:26Z","snapshot_observed_at":"2026-08-04T12:32:53.090165Z","submitted_at":"2025-02-20T17:49:26Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2502.14768","doi":"10.48550/arxiv.2502.14768","metadata_source":"pith","pith_arxiv_id":"2502.14768","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","venue":"cs.CL","work_id":"b1f42628-30b7-4593-80ff-813523035c23","year":2025},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"cited_paper":"/paper/2502.14768","citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:b53b24e451b0bc2677e7418b7d1d1a23e6c482d72b9b9c96a7120741e0f378ff","observation_id":"40741bdb-1d0d-43a4-b460-8705c21db40a","resolution":{"observed_at":"2026-05-18T08:41:08.312945Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:11b62060227c2ebcec1bea1f7f56767782b73b196b055e00bcd37360bbf8d890","observation_id":"738d2395-8ced-492f-8188-a3ea26785b82","resolution":{"observed_at":"2026-05-18T08:41:08.359669Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":"2409.12122","doi":"10.18653/v1/2025.emnlp-main.712","metadata_source":"pith","pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","venue":"cs.CL","work_id":"a097c5d4-6d32-46ee-9826-57d532bbfc9c","year":2024},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:ddd4f02d0530a0d322984b931882d79c44a2fc27a607d84b1bdb82d481180d6f","observation_id":"466472d6-e19a-43b4-b170-81f20f369d59","resolution":{"observed_at":"2026-05-18T08:41:08.330839Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.13124","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:40:08.275804Z","title":"Naturalreasoning: Reasoning in the wild with 2.8 m challenging questions","venue":null,"work_id":"d185ff64-8137-4c75-a12b-852746b6bd58","year":2025},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:6cd23035806ea00cb056a44f2ea20e0fd9e4d25be95b8ec456c717be070956f4","observation_id":"ceff8fe6-8ee9-4414-b8ed-4b4bb7f0dd43","resolution":{"observed_at":"2026-05-18T08:41:08.325104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09629","last_updated":"2024-03-18T07:56:48Z","snapshot_observed_at":"2026-07-31T09:25:34.205362Z","submitted_at":"2024-03-14T17:58:16Z","title":"Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking","version":2},"cited_work":{"arxiv_id":"2403.09629","doi":"10.48550/arxiv.2403.09629","metadata_source":"pith","pith_arxiv_id":"2403.09629","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking","venue":"cs.CL","work_id":"cd82874a-9e9d-46cb-9716-a06d454a9c7e","year":2024},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"cited_paper":"/paper/2403.09629","citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:662c5db4954d1f356f2906edd05a3d0f08704a5be10046a316f2fcf4d979ba9e","observation_id":"975deb2d-d305-485c-aafe-4dac78aed692","resolution":{"observed_at":"2026-05-18T08:41:08.376353Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00024","last_updated":"2025-05-12T03:01:39Z","snapshot_observed_at":"2026-08-01T20:37:21.838499Z","submitted_at":"2025-04-25T02:55:21Z","title":"Nemotron-Research-Tool-N1: Exploring Tool-Using Language Models with Reinforced Reasoning","version":2},"cited_work":{"arxiv_id":"2505.00024","doi":"10.48550/arxiv.2505.00024","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00024","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Nemotron-Research-Tool-N1: Exploring tool-using language models with reinforced reasoning","venue":"ArXiv.org","work_id":"861a7bc1-6e5d-413f-84e6-523c0ff999b1","year":2025},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"cited_paper":"/paper/2505.00024","citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:852df8d77b96aec7738c01c28f4c46d8d25b0428a87a5dc85ef17877c20ebde0","observation_id":"6a2fa7a9-9b77-4d60-865b-50ae03e35d12","resolution":{"observed_at":"2026-05-18T08:41:08.319271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":"2506.05176","doi":"10.1016/j.displa.2025.103255","metadata_source":"pith","pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","venue":"cs.CL","work_id":"bab684a8-d933-426c-a19e-2c855a0d1f59","year":2025},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:cb8b17ea25cad32c7d305279ae41b24e5d7774b539eecdf1121fa614612d7fc6","observation_id":"c618ce7f-71c6-448d-adf0-0207f780b669","resolution":{"observed_at":"2026-05-18T08:41:08.337290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17115","last_updated":"2025-02-14T16:44:08Z","snapshot_observed_at":"2026-07-06T19:22:14.655041Z","submitted_at":"2024-09-25T17:28:13Z","title":"Programming Every Example: Lifting Pre-training Data Quality Like Experts at Scale","version":2},"cited_work":{"arxiv_id":"2409.17115","doi":"10.48550/arxiv.2409.17115","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.17115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2409.17115 , year=","venue":"arXiv (Cornell University)","work_id":"cd76eda1-2587-46e9-91dd-ececce05ceb2","year":2024},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"cited_paper":"/paper/2409.17115","citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:b6cfe0944969db13f4e9f6dbe63140426fa6ca962604501d90c95f2d573cd172","observation_id":"b14b2432-90c1-4405-9633-41bacbf3e64a","resolution":{"observed_at":"2026-05-18T08:41:08.306680Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02807","last_updated":"2025-04-03T17:52:07Z","snapshot_observed_at":"2026-07-06T21:03:50.078667Z","submitted_at":"2025-04-03T17:52:07Z","title":"MegaMath: Pushing the Limits of Open Math Corpora","version":1},"cited_work":{"arxiv_id":"2504.02807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.02807","snapshot_observed_at":"2026-07-04T01:09:19.755056Z","title":"Megamath: Pushing the limits of open math corpora","venue":null,"work_id":"cc63ee94-8d30-4dad-ab33-05247e9e7b7b","year":2025},"citing_paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T08:39:54.747656Z"},"links":{"cited_paper":"/paper/2504.02807","citing_paper":"/paper/2510.06499"},"observation_digest":"sha256:b5770088700413b2a64a09dd3f438eba664c58e2cf0e870be4382c1bacd6a50b","observation_id":"eb87b5fe-d310-4f5a-af58-ca3f21acf98a","resolution":{"observed_at":"2026-05-18T08:41:08.385978Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2510.06499","last_updated":"2026-04-10T04:08:43Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-07T22:30:59Z","title":"Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":9,"verified_fuzzy":3},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2510.06499."}