{"as_of":"2026-08-07T19:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:93b44b38f84d186881cc7af32a9eea2477b0a96f7f3882228a562e5a08edcf9a","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T10:53:08.933314Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.27271/citation-record","integrity":"/paper/2607.27271/integrity","json":"/paper/2607.27271/citation-record.json","paper":"/paper/2607.27271"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-01T10:53:08.874539Z","title":"Dou, Z.; Zhao, Q.; Wan, Z.; Xia, X.; and Biswas, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.874539Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:e6fc777cc41cb70c220a678e0bc1083f5bb7c135e8575902f23c220bcb1e31b4","observation_id":"e9330891-4e2e-4c05-9b43-746cf8730ead","resolution":{"observed_at":"2026-08-01T10:53:08.874539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05137","last_updated":"2026-04-06T19:56:26Z","snapshot_observed_at":"2026-07-06T22:53:55.926521Z","submitted_at":"2026-04-06T19:56:26Z","title":"EffiPair: Improving the Efficiency of LLM-generated Code with Relative Contrastive Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.05137","snapshot_observed_at":"2026-08-01T10:53:08.883214Z","title":"Hendrycks,D.;Basart,S.;Kadavath,S.;Mazeika,M.;Arora, A.; Guo, E.; Burns, C.; Puranik, S.; He, H.; Song, D.; and Steinhardt, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.883214Z"},"links":{"cited_paper":"/paper/2604.05137","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:a357e32d6a4d5bcbe8a5b8513429f0130377719d18a83b9133eb186531959f82","observation_id":"bef4cad0-d52b-4b87-83e6-eded72b0f436","resolution":{"observed_at":"2026-08-01T10:53:08.883214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:53:08.885978Z","title":"InAdvances in Neural Information Pro- cessing Systems","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.885978Z"},"links":{"citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:c5f4a3e3f8346956121975d420ebb57fdedd170073aba082b05d6293681ffc55","observation_id":"47a8dcb2-3c67-45f0-a525-b78c749fc98f","resolution":{"observed_at":"2026-08-01T10:53:08.885978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15222","last_updated":"2026-05-13T08:10:26Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-13T08:10:26Z","title":"PerfCodeBench: Benchmarking LLMs for System-Level High-Performance Code Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15222","snapshot_observed_at":"2026-08-01T10:53:08.891638Z","title":"arXiv:2605.15222","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.891638Z"},"links":{"cited_paper":"/paper/2605.15222","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:da1069dbf8a24da8872a01892dd8c803814146e158647cab8e4355363f560737","observation_id":"60951eb3-aa24-4776-857b-6cb220a5d79c","resolution":{"observed_at":"2026-08-01T10:53:08.891638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11895","last_updated":"2026-05-16T19:19:54Z","snapshot_observed_at":"2026-07-06T22:41:58.373427Z","submitted_at":"2026-01-17T03:33:08Z","title":"DevBench: A Realistic, Developer-Informed Benchmark for Code Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11895","snapshot_observed_at":"2026-08-01T10:53:08.895092Z","title":"Le, H.; Wang, Y.; Gotmare, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.895092Z"},"links":{"cited_paper":"/paper/2601.11895","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:6d2c2a81b959de83bf5eeccc301f06e9d633229fdbca64615411b7dffc60f8ba","observation_id":"9a5b7dc2-b0aa-4a0d-9c6f-b02a1f79626c","resolution":{"observed_at":"2026-08-01T10:53:08.895092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.07619","last_updated":"2026-07-08T16:36:03Z","snapshot_observed_at":"2026-08-07T18:03:39.958190Z","submitted_at":"2026-07-08T16:36:03Z","title":"Rethinking Code Performance Benchmarks for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.07619","snapshot_observed_at":"2026-08-01T10:53:08.900571Z","title":"Li, X.; Wang, A.; Wang, G.; Li, J.; and Shum, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.900571Z"},"links":{"cited_paper":"/paper/2607.07619","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:99bca1d507ad7566d21d07ba3827090b8ecb576218999be33aaf82e742b22a48","observation_id":"1b53eb0d-ebe6-4be9-9aee-8b7a819913ef","resolution":{"observed_at":"2026-08-01T10:53:08.900571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14111","last_updated":"2026-08-05T22:03:49Z","snapshot_observed_at":"2026-08-07T18:19:45.959517Z","submitted_at":"2025-07-18T17:43:56Z","title":"CUDA-L1: Improving CUDA Optimization via Contrastive Reinforcement Learning","version":12},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14111","snapshot_observed_at":"2026-08-01T10:53:08.903173Z","title":"Liu, J.; Xia, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.903173Z"},"links":{"cited_paper":"/paper/2507.14111","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:32c5d9e90db0206b95a7c9c5b2673f81e321ebba4df489312d3a3c24f745f04a","observation_id":"d62ac326-57e1-4974-9c40-44d477d16e37","resolution":{"observed_at":"2026-08-01T10:53:08.903173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04349","last_updated":"2023-11-13T03:49:27Z","snapshot_observed_at":"2026-07-06T15:51:58.017259Z","submitted_at":"2023-07-10T05:18:18Z","title":"RLTF: Reinforcement Learning from Unit Test Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04349","snapshot_observed_at":"2026-08-01T10:53:08.905721Z","title":"InConference on Language Modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.905721Z"},"links":{"cited_paper":"/paper/2307.04349","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:4cdec977d526f062b592935663658f0270c7561d90bd7b20bf8fbd2cf67d949f","observation_id":"59afdc66-0d0a-4922-b340-a70b187a9293","resolution":{"observed_at":"2026-08-01T10:53:08.905721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:53:08.908244Z","title":"OpenAI.2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.908244Z"},"links":{"citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:11116ccb7def6dd6832b900338c94d96cabc517cbedb1e895858c601cb4be561","observation_id":"4b5be7ab-7c0d-4ee0-b2c6-a0aaa95bcc30","resolution":{"observed_at":"2026-08-01T10:53:08.908244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:53:08.910684Z","title":"Ouyang, A.; Guo, S.; Arora, S.; Zhang, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.910684Z"},"links":{"citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:99f3502a3254b64f8971a395d5c76497277ddd03a49e1f717bf8801c39caa96c","observation_id":"f0cb727b-2dc9-4458-938c-0b93bc2c43a9","resolution":{"observed_at":"2026-08-01T10:53:08.910684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03578","last_updated":"2024-11-18T06:22:38Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-11-18T06:22:38Z","title":"PerfCodeGen: Improving Performance of LLM Generated Code with Execution Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03578","snapshot_observed_at":"2026-08-01T10:53:08.913097Z","title":"Peng, Y.; Wan, J.; Li, Y.; and Ren, X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.913097Z"},"links":{"cited_paper":"/paper/2412.03578","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:0e2840821f81c0c65ea4400cc237513da5ef7859dd9b4c50f5403a9641fe27a5","observation_id":"0fb95a22-b8e5-43fb-b3b0-24e334074edd","resolution":{"observed_at":"2026-08-01T10:53:08.913097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13004","last_updated":"2025-05-19T11:43:37Z","snapshot_observed_at":"2026-08-07T15:43:17.077566Z","submitted_at":"2025-05-19T11:43:37Z","title":"EffiBench-X: A Multi-Language Benchmark for Measuring Efficiency of LLM-Generated Code","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13004","snapshot_observed_at":"2026-08-01T10:53:08.915570Z","title":"Qiu,R.;Zeng,W.W.;Ezick,J.;Lott,C.;andTong,H.2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.915570Z"},"links":{"cited_paper":"/paper/2505.13004","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:eae2c06c07d094c581646ebd4910584c5cc3981a0293daa43d35d728b29f0638","observation_id":"32ec4a62-5626-4d13-b3c9-133104ea53c4","resolution":{"observed_at":"2026-08-01T10:53:08.915570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-01T10:53:08.918161Z","title":"Shen, B.; Zhang, J.; Chen, T.; Zan, D.; Geng, B.; Fu, A.; Zeng,M.;Yu,A.;Ji,J.;Zhao,J.;Guo,Y.;andWang,Q.2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.918161Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:783d423ffd112aced67f04d58c9b4f145cc278ef28ed7f1dafeb0bbc9efca934","observation_id":"78ce596a-61be-40fb-bff8-8c7f36077942","resolution":{"observed_at":"2026-08-01T10:53:08.918161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30478","last_updated":"2026-05-28T18:50:00Z","snapshot_observed_at":"2026-08-05T07:46:46.502172Z","submitted_at":"2026-05-28T18:50:00Z","title":"Improving Small Language Models for Code Generation with Reinforcement Learning from Verification Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30478","snapshot_observed_at":"2026-08-01T10:53:08.923482Z","title":"Wang, X.; Li, B.; Song, Y.; Xu, F","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.923482Z"},"links":{"cited_paper":"/paper/2605.30478","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:4e5182d866aceab4bf19ab0854ada93bbf796949bb6088e0b3378b02dc02c0b7","observation_id":"93a0138e-48bf-473a-bf74-2024bf7e6166","resolution":{"observed_at":"2026-08-01T10:53:08.923482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:53:08.925914Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.925914Z"},"links":{"citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:1e681ab84edbf07570707cce3ddd6af5cdd165bbd9306c8f3bc43f003a4cb542","observation_id":"bef56da3-3259-4401-a3f7-c5ecf94863d5","resolution":{"observed_at":"2026-08-01T10:53:08.925914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-01T10:53:08.928329Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.928329Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:f9a6dbc295ffbbebe0512e5af470ac9e13cbee5c4b3c1611889f880b7855f896","observation_id":"35865d5a-124b-4e43-81bc-dbcf1707ed6d","resolution":{"observed_at":"2026-08-01T10:53:08.928329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:53:08.930892Z","title":"Zhu, X.; Zhou, X.; Zhu, B.; Hu, H.; Du, M.; Zhang, H.; Wang, H.; and Guo, Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.930892Z"},"links":{"citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:a9fb292cfa38d6af1c286c4617252960dbd1aef9f8216f853e0636336bceea05","observation_id":"59c1f194-136d-4baf-a680-679c52266d59","resolution":{"observed_at":"2026-08-01T10:53:08.930892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.17684","last_updated":"2026-05-17T16:26:27Z","snapshot_observed_at":"2026-08-03T09:27:34.305989Z","submitted_at":"2026-02-04T17:56:00Z","title":"CodeScaler: Scaling Code LLM Training and Test-Time Inference via Reward Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.17684","snapshot_observed_at":"2026-08-01T10:53:08.933314Z","title":"arXiv preprint arXiv:2602.17684","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.933314Z"},"links":{"cited_paper":"/paper/2602.17684","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:4bd1227742200d1168713c86c0891552355c13271abc4da9ecbbc614e68cf1fa","observation_id":"00c04b33-b9d4-4edc-b362-566fde1b79ba","resolution":{"observed_at":"2026-08-01T10:53:08.933314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-01T10:53:08.870724Z","title":"arXiv preprint arXiv:2108.07732","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.870724Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:d00dcd05e3aa1ec4d034ffb32e567a64498dbf9d664d8fbb05cdb091cd156348","observation_id":"4b3ae5e2-6859-4763-aed5-c6d71a0ab1cb","resolution":{"observed_at":"2026-08-01T10:53:08.870724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.01780","last_updated":"2022-11-03T08:32:59Z","snapshot_observed_at":"2026-08-06T05:06:31.977572Z","submitted_at":"2022-07-05T02:42:15Z","title":"CodeRL: Mastering Code Generation through Pretrained Models and Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.01780","snapshot_observed_at":"2026-08-01T10:53:08.897721Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.897721Z"},"links":{"cited_paper":"/paper/2207.01780","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:dacc45f24116d2a75499e708a11874d9aeb121ed4437643765d43f2f6809c9b6","observation_id":"a8fb92f1-ad13-46ae-8ac5-4b2272b2de53","resolution":{"observed_at":"2026-08-01T10:53:08.897721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07867","last_updated":"2024-04-26T16:41:55Z","snapshot_observed_at":"2026-08-07T01:31:28.444802Z","submitted_at":"2023-02-15T18:59:21Z","title":"Learning Performance-Improving Code Edits","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07867","snapshot_observed_at":"2026-08-01T10:53:08.920912Z","title":"Skopin, E.; and Kotelnikov, E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.920912Z"},"links":{"cited_paper":"/paper/2302.07867","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:a29f7f0bce7bd2437fe4380a160afa669f0f6da404ce85a57ee8d735962f23b8","observation_id":"05535d48-e427-44af-b35c-e4acd4361a96","resolution":{"observed_at":"2026-08-01T10:53:08.920912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02089","last_updated":"2025-02-18T11:39:46Z","snapshot_observed_at":"2026-07-06T19:26:38.002071Z","submitted_at":"2024-10-02T23:25:17Z","title":"RLEF: Grounding Code LLMs in Execution Feedback with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02089","snapshot_observed_at":"2026-08-01T10:53:08.880515Z","title":"Guo, D.; Yang, D.; Zhang, H.; et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.880515Z"},"links":{"cited_paper":"/paper/2410.02089","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:d5f1d6de7428be55188dba21b8eb04d464c76cc4fb4ae6c2a8352dab1eab3c33","observation_id":"9989336a-ed70-49c6-9097-e3ccdfc965fc","resolution":{"observed_at":"2026-08-01T10:53:08.880515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18471","last_updated":"2026-04-22T14:35:52Z","snapshot_observed_at":"2026-08-02T15:24:09.026985Z","submitted_at":"2025-10-21T09:48:06Z","title":"CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.18471","snapshot_observed_at":"2026-08-01T10:53:08.888767Z","title":"Jimenez, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.888767Z"},"links":{"cited_paper":"/paper/2510.18471","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:49703ae19d7884cedd9083f846c9787b9cc0dc2ab7c98e34434ba5aefe524f76","observation_id":"e337d119-be4c-46a8-b7c0-d02df08c9801","resolution":{"observed_at":"2026-08-01T10:53:08.888767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.24812","last_updated":"2026-05-24T01:47:30Z","snapshot_observed_at":"2026-07-06T23:34:52.129354Z","submitted_at":"2026-05-24T01:47:30Z","title":"CoRe-Code: Collaborative Reinforcement Learning for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.24812","snapshot_observed_at":"2026-08-01T10:53:08.877543Z","title":"Du,M.;Luu,A.T.;Ji,B.;Liu,Q.;andNg,S.-K.2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T10:53:08.877543Z"},"links":{"cited_paper":"/paper/2605.24812","citing_paper":"/paper/2607.27271"},"observation_digest":"sha256:7bc8801a32a35dc2a6f6d4551beb53fbd91d273d3a3a9289a4dad2f591d97ed8","observation_id":"db153e02-5e0c-400f-b798-53df2e0cc360","resolution":{"observed_at":"2026-08-01T10:53:08.877543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.27271","last_updated":"2026-07-29T11:39:55Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T17:49:02.982269Z","submitted_at":"2026-07-29T11:39:55Z","title":"RLPF: Reinforcement Learning from Performance Feedback for Code Generation"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2607.27271."}