{"as_of":"2026-08-07T12:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:34d1c317d607b66da4f1fc3dd17da713b97679997e3bff21436ed73a38042c26","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:14:40.383156Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01804/citation-record","integrity":"/paper/2608.01804/integrity","json":"/paper/2608.01804/citation-record.json","paper":"/paper/2608.01804"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.02089","last_updated":"2025-02-18T11:39:46Z","snapshot_observed_at":"2026-07-06T19:26:38.002071Z","submitted_at":"2024-10-02T23:25:17Z","title":"RLEF: Grounding Code LLMs in Execution Feedback with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02089","snapshot_observed_at":"2026-08-07T00:14:38.260775Z","title":"Jonas Gehring, Kunhao Zheng, Jade Copet, Vegard Mella, Quentin Carbonneaux, Taco Cohen, and Gabriel Synnaeve","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.260775Z"},"links":{"cited_paper":"/paper/2410.02089","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:4babd76ededc31a46f84919e4184c6350f81d4f1ab3b2ad451438b124cce7339","observation_id":"4b0e5296-46c0-4996-9f78-40f3af77103c","resolution":{"observed_at":"2026-08-07T00:14:38.260775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17746","last_updated":"2025-10-03T01:55:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-23T17:57:55Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17746","snapshot_observed_at":"2026-08-07T00:14:38.347899Z","title":"Rubrics as rewards: Reinforcement learning beyond verifiable domains.arXiv preprint arXiv:2507.17746,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.347899Z"},"links":{"cited_paper":"/paper/2507.17746","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:63354927910245be1d5d59903f68ae69b1892a47951f4b9508874dbbe1640751","observation_id":"2564e9df-8411-4ba3-a91f-e2cfd227ce72","resolution":{"observed_at":"2026-08-07T00:14:38.347899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.12790","last_updated":"2025-08-18T10:06:08Z","snapshot_observed_at":"2026-08-05T19:15:41.254461Z","submitted_at":"2025-08-18T10:06:08Z","title":"Reinforcement Learning with Rubric Anchors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.12790","snapshot_observed_at":"2026-08-07T00:14:38.445310Z","title":"Arnav Kumar Jain, Gonzalo Gonzalez-Pumariega, Wayne Chen, Alexander M Rush, Wenting Zhao, and Sanjiban Choudhury","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.445310Z"},"links":{"cited_paper":"/paper/2508.12790","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:f2676fe1500b6d93567cb0c69fc8a199da1e76605424e2e8a63188a589ec84d5","observation_id":"5ef81299-f809-4b3c-8eaf-dc99e5af92e2","resolution":{"observed_at":"2026-08-07T00:14:38.445310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:38.546266Z","title":"Reveal: Self-evolving code agents via reliable self-verification.arXiv preprint arXiv:2506.11442,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.546266Z"},"links":{"citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:00cd28b9ba7895a264035d3f878d56f5f3fca4373524eb3bdb5ea2efbd4ab5e9","observation_id":"56f4a5a0-6596-492e-81d2-500366102545","resolution":{"observed_at":"2026-08-07T00:14:38.546266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14111","last_updated":"2026-08-05T22:03:49Z","snapshot_observed_at":"2026-08-07T11:56:35.783044Z","submitted_at":"2025-07-18T17:43:56Z","title":"CUDA-L1: Improving CUDA Optimization via Contrastive Reinforcement Learning","version":12},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14111","snapshot_observed_at":"2026-08-07T00:14:38.778592Z","title":"Cuda-l1: Improving cuda optimization via contrastive reinforcement learning.arXiv preprint arXiv:2507.14111,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.778592Z"},"links":{"cited_paper":"/paper/2507.14111","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:3d4cec48ca0f62bf971671ec63b46bf224ee56e1a408f16a41ed17a59f56a60f","observation_id":"39c2a086-d479-403e-9c5a-37aa61e6dba7","resolution":{"observed_at":"2026-08-07T00:14:38.778592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-07T00:14:39.097324Z","title":"Understanding r1-zero-like training: A critical perspective.arXiv preprint arXiv:2503.20783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.097324Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:ae9dd5a99920f1eeec7a1b126f12a9b1b2673e60194e1f8ca4eefd2e025165f0","observation_id":"4234a704-7a43-4fcb-a77e-432e94646b85","resolution":{"observed_at":"2026-08-07T00:14:39.097324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-07T00:14:39.265466Z","title":"Starcoder 2 and the stack v2: The next generation.arXiv preprint arXiv:2402.19173,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.265466Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:8f02e6cd7524f25d729a53baf98c073f940b51210a18a19815670019151aece2","observation_id":"d0006dbf-00a7-4acc-ab6f-df68a9b7958c","resolution":{"observed_at":"2026-08-07T00:14:39.265466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10517","last_updated":"2025-02-14T19:30:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T19:30:53Z","title":"KernelBench: Can LLMs Write Efficient GPU Kernels?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10517","snapshot_observed_at":"2026-08-07T00:14:39.414794Z","title":"Ker- nelbench: Can llms write efficient gpu kernels?arXiv preprint arXiv:2502.10517,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.414794Z"},"links":{"cited_paper":"/paper/2502.10517","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:0e20880391a85bb2f2596c4d9109dd55ddf1a038863294fdde174ccd2ab2dc95","observation_id":"0b2cde1c-1b24-413f-a027-d432e7ec604e","resolution":{"observed_at":"2026-08-07T00:14:39.414794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T00:14:39.532200Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.532200Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:7268fb9689d25fd09fe3bf0f8d4ace7105b11df3491248c07df3d299141f0665","observation_id":"54b62edc-d276-476e-89d1-a7de19a0f35e","resolution":{"observed_at":"2026-08-07T00:14:39.532200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-08-07T00:14:39.834527Z","title":"Kimi k2: Open agentic intelligence.arXiv preprint arXiv:2507.20534,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.834527Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:2d8f4f90e448c9a545f8109ceb3df9760fe83401bed13a29fe4de2a649cb0964","observation_id":"0a58342c-d794-4fbf-bb55-52ea57917e14","resolution":{"observed_at":"2026-08-07T00:14:39.834527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02120","last_updated":"2024-06-07T02:50:56Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:50:35Z","title":"Magicoder: Empowering Code Generation with OSS-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02120","snapshot_observed_at":"2026-08-07T00:14:39.998379Z","title":"Magicoder: Empowering code generation with oss-instruct.arXiv preprint arXiv:2312.02120,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.998379Z"},"links":{"cited_paper":"/paper/2312.02120","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:07fb9f6725fdc8961641806c0ca182323ebbb87fb6f8f16583ca7a4cbff8afff","observation_id":"32bfd783-1301-4b4f-9eee-22a65c346839","resolution":{"observed_at":"2026-08-07T00:14:39.998379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02780","last_updated":"2026-01-08T05:52:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-06T07:31:47Z","title":"MiMo-V2-Flash Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.02780","snapshot_observed_at":"2026-08-07T00:14:40.119134Z","title":"Mimo-v2-flash technical report.arXiv preprint arXiv:2601.02780,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:40.119134Z"},"links":{"cited_paper":"/paper/2601.02780","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:5789446dfb76f96d2707760745f4d5896486490ad4ac9e4cb793cc143839f3eb","observation_id":"e0d68600-e5c4-403b-a434-0cc001641b6b","resolution":{"observed_at":"2026-08-07T00:14:40.119134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:41.115082Z","title":"Kodcode: A diverse, challenging, and verifiable synthetic dataset for coding","venue":null,"work_id":"474c12a0-fd79-491e-821a-903ae6750945","year":2025},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:40.126059Z"},"links":{"citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:cfd062cd5fca02d556b6d0632cbe0fffa58679516312a556dda6a63383d9cd01","observation_id":"0bf33520-9fc8-41e6-8c90-0ba4146f3059","resolution":{"observed_at":"2026-08-07T00:14:41.196047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T00:14:40.175694Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:40.175694Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:6efd20fa498cca682a1f15162050490ccc1378df0edaa5b85b6430bc4d995c8e","observation_id":"8718100a-9498-49fc-9ecf-19a4602aad3e","resolution":{"observed_at":"2026-08-07T00:14:40.175694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05118","last_updated":"2025-04-11T02:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T14:21:11Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05118","snapshot_observed_at":"2026-08-07T00:14:40.240344Z","title":"Vapo: Efficient and reliable reinforcement learning for advanced reasoning tasks.URL https://arxiv","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:40.240344Z"},"links":{"cited_paper":"/paper/2504.05118","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:40a369346a9b03dea9645d2340aab652196f8f200f6fd3747fcf8d4fddae9f89","observation_id":"a14fd13b-69db-4100-8de4-068ed528d308","resolution":{"observed_at":"2026-08-07T00:14:40.240344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-07T00:14:40.307397Z","title":"Glm-5: from vibe coding to agentic engineering.arXiv preprint arXiv:2602.15763,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:40.307397Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:75d87b4913d095669b68f24c6ce8504350ef4e7554fcbad57342e45996f9227d","observation_id":"5b85acec-c6e0-4e02-9496-c7c4004362dc","resolution":{"observed_at":"2026-08-07T00:14:40.307397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18071","last_updated":"2025-07-28T11:11:33Z","snapshot_observed_at":"2026-08-06T04:31:03.113409Z","submitted_at":"2025-07-24T03:50:32Z","title":"Group Sequence Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.18071","snapshot_observed_at":"2026-08-07T00:14:40.383156Z","title":"Group sequence policy optimization.arXiv preprint arXiv:2507.18071,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:40.383156Z"},"links":{"cited_paper":"/paper/2507.18071","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:d4c6ba43e8133ed5d18ff4a60c1a5d1d46b9f6c39248c03e12d934e4e460f666","observation_id":"ea9a0ebb-dcb4-4436-856d-c7534c2aee98","resolution":{"observed_at":"2026-08-07T00:14:40.383156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-07T00:14:39.656558Z","title":"Hybridflow: A flexible and efficient rlhf framework.arXiv preprint arXiv: 2409.19256,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.656558Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:c72e3667730fb968047d31fc9dcf4695df9dfd4a009ca23873947fa8a2379ea3","observation_id":"3e3f3bbe-4b24-453e-a60f-871f4f1975d5","resolution":{"observed_at":"2026-08-07T00:14:39.656558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.04847","last_updated":"2026-06-03T13:15:30Z","snapshot_observed_at":"2026-08-01T18:57:38.124358Z","submitted_at":"2026-06-03T13:15:30Z","title":"MusaCoder: Native GPU Kernel Generation with Full-Stack Training on Moore Threads GPU","version":1},"cited_work":{"arxiv_id":"2606.04847","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.04847","snapshot_observed_at":"2026-08-07T00:14:40.952443Z","title":"MusaCoder: Native GPU Kernel Generation with Full-Stack Training on Moore Threads GPU","venue":"cs.CV","work_id":"88936c8e-c05b-465e-a712-e2d062b85e47","year":2026},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:37.966451Z"},"links":{"cited_paper":"/paper/2606.04847","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:ed8e1b17323aa4def6ad24173e6e947c6f4c0a33a434ef2d8d096dc381e3108e","observation_id":"88217968-cbb4-4fbc-802a-1e4e6990bbe8","resolution":{"observed_at":"2026-08-07T00:14:41.018986Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:38.925443Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.925443Z"},"links":{"citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:32c4d153947b0de169fbd430c33a0a9a6f650968a567887748f937a437a27d96","observation_id":"214ad3cc-1331-461f-be12-d4f35a935a5b","resolution":{"observed_at":"2026-08-07T00:14:38.925443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T00:14:37.907102Z","title":"Program synthesis with large language models.arXiv preprint arXiv:2108.07732,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:37.907102Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:42293d80a63b221baac8492d48afce5806ccbf16f894ac1bd47e3c7630fb5c00","observation_id":"af69c148-4d9f-48a6-8c5b-992d3c69eff3","resolution":{"observed_at":"2026-08-07T00:14:37.907102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:38.071821Z","title":"Cuda agent: Large-scale agentic rl for high-performance cuda kernel generation.arXiv preprint arXiv:2602.24286,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.071821Z"},"links":{"citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:45a72aee65867d24df041c47f7f264547b830047fc66cd6ad00cd8359b7eaae2","observation_id":"0d6e8044-d512-486e-ae7a-42d856a596ea","resolution":{"observed_at":"2026-08-07T00:14:38.071821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:41.284115Z","title":"Chanakya Ekbote, Vijay Lingam, Behrooz Omidvar Tehrani, Jun Huan, Sujay Sanghavi, Anoop Deoras, and Stefano Soatto","venue":null,"work_id":"f18c04f3-79f1-44d0-bbeb-ba137866833b","year":2026},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.181783Z"},"links":{"citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:2aa700a5a87b930b9307837d3d7eba7594a279ff1d7a4aa2683996e429410cba","observation_id":"1f6446a1-34a0-4d75-a3f3-3ac18298b60d","resolution":{"observed_at":"2026-08-07T00:14:41.363450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T11:11:55.240860Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2608.01804."}