{"as_of":"2026-08-08T11:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d5bc17e97e876c11a87d55ec1de519dfd06ffad6ab1b6d403edd68f8372dd9bc","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:35:02.149902Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T09:22:06.285118Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T09:23:10.509262Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"cited_work":{"arxiv_id":"2506.04894","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04894","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Icpc-Eval: Probing the frontiers of LLM reasoning with competitive programming contests","venue":null,"work_id":"df5398e9-b201-40b0-afb0-f0a0ec09947e","year":2025},"citing_paper":{"arxiv_id":"2605.08905","last_updated":"2026-05-09T11:57:25Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T11:57:25Z","title":"Forge: Quality-Aware Reinforcement Learning for NP-Hard Optimization in LLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-12T02:44:33.143247Z"},"links":{"cited_paper":"/paper/2506.04894","citing_paper":"/paper/2605.08905"},"observation_digest":"sha256:9d25baf2a3af535434c383b91faaa9e80db8e52cdaa518843b688a75f0f9627a","observation_id":"e4539fd5-b99d-4d9f-a2a4-64a894d074c0","resolution":{"observed_at":"2026-05-12T02:46:18.912715Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"cited_work":{"arxiv_id":"2506.04894","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04894","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Icpc-Eval: Probing the frontiers of LLM reasoning with competitive programming contests","venue":null,"work_id":"df5398e9-b201-40b0-afb0-f0a0ec09947e","year":2025},"citing_paper":{"arxiv_id":"2605.18073","last_updated":"2026-05-18T08:55:30Z","snapshot_observed_at":"2026-07-06T23:28:59.503300Z","submitted_at":"2026-05-18T08:55:30Z","title":"A-ProS: Towards Reliable Autonomous Programming Through Multi-Model Feedback","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T09:22:06.285118Z"},"links":{"cited_paper":"/paper/2506.04894","citing_paper":"/paper/2605.18073"},"observation_digest":"sha256:66132ec32dc6082abd0dde8d261aa8527029a57327cf30870dba7c66ea639170","observation_id":"cd3847b9-467e-4bdf-bfa5-13c1fb21692a","resolution":{"observed_at":"2026-05-20T09:23:10.510877Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04894/citation-record","integrity":"/paper/2506.04894/integrity","json":"/paper/2506.04894/citation-record.json","paper":"/paper/2506.04894"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T10:35:02.064673Z","title":"A Survey of Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.064673Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:f59a831748ed66cfc9449e9bc884b6189d74db040210993f90a2ab5cf74c4539","observation_id":"e77ef952-976b-4ba7-94ab-d1b4ac2d1122","resolution":{"observed_at":"2026-08-07T10:35:02.064673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.397695Z","title":"https://openai.com/o1/, 2024","venue":null,"work_id":"2aaf1cef-fcaf-47e0-915b-c62dd77b0cf7","year":2024},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.068921Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:1d2f2f2985e7a64cc92a3655ace248bb0a4d181782242044ef12fa3e96d2de88","observation_id":"26129e3c-be2f-4187-b8b5-68cf2eba32cc","resolution":{"observed_at":"2026-08-07T10:35:02.400755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T10:35:02.072166Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.072166Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:82869977bc26550c4e7ad7f94712467e85004effbea332a29e3745b8fda9c58a","observation_id":"ee4e85c7-7869-4b11-a110-3191341deefd","resolution":{"observed_at":"2026-08-07T10:35:02.072166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.387381Z","title":null,"venue":null,"work_id":"1cbad936-b05a-4a38-8764-289a1a02ee85","year":null},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.075898Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:d8a8618a2653ee540e118c507d775f1150e553bd34c3cb59b1cb96bea21c5c2c","observation_id":"8297e588-252c-468d-9eac-ec1d5cc78065","resolution":{"observed_at":"2026-08-07T10:35:02.390764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-07T10:35:02.078965Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.078965Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:b35869cce6088b93c393dd981f54154f741e5bf75df03fc18231e9cbeb61665a","observation_id":"3f1773dd-1287-4e9a-be38-143068c21443","resolution":{"observed_at":"2026-08-07T10:35:02.078965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10952","last_updated":"2024-04-16T23:27:38Z","snapshot_observed_at":"2026-08-07T05:16:48.851507Z","submitted_at":"2024-04-16T23:27:38Z","title":"Can Language Models Solve Olympiad Programming?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10952","snapshot_observed_at":"2026-08-07T10:35:02.083166Z","title":"Can Language Models Solve Olympiad Programming? (arXiv:2404.10952), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.083166Z"},"links":{"cited_paper":"/paper/2404.10952","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:dc55453211238d6b9d456b39d523a81e4f1c4442b963452bd28d9a7675c349a9","observation_id":"0153c955-1265-4112-80d0-b32548f7555f","resolution":{"observed_at":"2026-08-07T10:35:02.083166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01257","last_updated":"2025-01-03T16:36:12Z","snapshot_observed_at":"2026-07-31T19:08:41.925451Z","submitted_at":"2025-01-02T13:49:00Z","title":"CodeElo: Benchmarking Competition-level Code Generation of LLMs with Human-comparable Elo Ratings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01257","snapshot_observed_at":"2026-08-07T10:35:02.087340Z","title":"CodeElo: Benchmarking Competition-level Code Generation of LLMs with Human-comparable Elo Ratings","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.087340Z"},"links":{"cited_paper":"/paper/2501.01257","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:6a6ec0cb860bc9a044064968fed0dee93138d420fc5bbdfc479b236d55efe635","observation_id":"7d8cdb37-b2b4-48b3-9ac1-14879d128c64","resolution":{"observed_at":"2026-08-07T10:35:02.087340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11366","last_updated":"2023-10-10T05:21:45Z","snapshot_observed_at":"2026-07-06T15:05:53.556198Z","submitted_at":"2023-03-20T18:08:50Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11366","snapshot_observed_at":"2026-08-07T10:35:02.091598Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.091598Z"},"links":{"cited_paper":"/paper/2303.11366","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:5c86bfd098e5d940b049e77df9eaf413dff5f428b53869d3099e236332a65dc2","observation_id":"88feea31-4c79-4398-9151-0cb66d8085c7","resolution":{"observed_at":"2026-08-07T10:35:02.091598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.376727Z","title":null,"venue":null,"work_id":"4cd6367c-e9a7-46f4-b240-2df5188c5078","year":null},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.095896Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:23dc409171760bae4155159c19f523a7f66cd0954dd5e943fb1187588e6ef670","observation_id":"ff232cf5-5847-4411-a246-d0c2a69f316f","resolution":{"observed_at":"2026-08-07T10:35:02.379835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T10:35:02.099581Z","title":"Program synthesis with large language models.arXiv preprint arXiv:2108.07732, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.099581Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:43c97ac88a2bf51a9146e96e346e679a74a9269ed5b8235bc7da1450b2427ee5","observation_id":"b71aa269-6c29-43ee-8021-8794b2ccca8a","resolution":{"observed_at":"2026-08-07T10:35:02.099581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.09938","last_updated":"2021-11-08T21:16:44Z","snapshot_observed_at":"2026-08-04T23:13:25.514661Z","submitted_at":"2021-05-20T17:58:42Z","title":"Measuring Coding Challenge Competence With APPS","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.09938","snapshot_observed_at":"2026-08-07T10:35:02.102815Z","title":"Measuring Coding Challenge Competence With APPS","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.102815Z"},"links":{"cited_paper":"/paper/2105.09938","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:b6346ac4d7ca72e41c654f8c998a6abf4704f9e0c550c051460782b635bea379","observation_id":"6cf597c2-5c45-42d9-bec7-0a2af91442fe","resolution":{"observed_at":"2026-08-07T10:35:02.102815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.367116Z","title":"Mankowitz, Esme Sutherland Robson, Pushmeet Kohli, Nando de Freitas, Koray Kavukcuoglu, and Oriol Vinyals","venue":null,"work_id":"3f5159cd-e39e-4560-a61e-ac8c83b0f7bb","year":2022},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.106739Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:4b0527a353c90553b0df6315d3cd8f093f2832272437629cb7521df58e7829c5","observation_id":"857463fc-6d53-45ae-bf67-fbd019d0a77c","resolution":{"observed_at":"2026-08-07T10:35:02.370461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03004","last_updated":"2023-11-06T07:16:58Z","snapshot_observed_at":"2026-07-06T14:59:03.634181Z","submitted_at":"2023-03-06T10:08:51Z","title":"xCodeEval: A Large Scale Multilingual Multitask Benchmark for Code Understanding, Generation, Translation and Retrieval","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03004","snapshot_observed_at":"2026-08-07T10:35:02.109846Z","title":"Saiful Bari, Xuan Long Do, Weishi Wang, Md Rizwan Parvez, and Shafiq Joty","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.109846Z"},"links":{"cited_paper":"/paper/2303.03004","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:c175c5130a720c994e5a30cfeb6a38cee382949ccb7aa13b3af08cadb93596b7","observation_id":"313fd987-6613-4c39-8bd6-c6425ed2de53","resolution":{"observed_at":"2026-08-07T10:35:02.109846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-07T10:35:02.113373Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.113373Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:4c09fdb4eb662ef92f551f5a0179c1e1dddea09f4304f47edde26be00ad3bc6f","observation_id":"20962425-cee4-4456-8526-4482cde1277e","resolution":{"observed_at":"2026-08-07T10:35:02.113373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.357294Z","title":"Multi-turn rl training for cuda kernel generation","venue":null,"work_id":"ce0b3a41-950b-464b-aa06-fb00b14d52b9","year":null},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.117383Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:7913c8846b4763e0b5cc6569922187de989ac51006c49ba9de5fe05189b0febc","observation_id":"64625227-ca3c-4f83-aa9e-2cf775e2a563","resolution":{"observed_at":"2026-08-07T10:35:02.360452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09896","last_updated":"2024-02-02T18:31:34Z","snapshot_observed_at":"2026-08-06T10:06:10.773161Z","submitted_at":"2023-06-16T15:13:17Z","title":"Is Self-Repair a Silver Bullet for Code Generation?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09896","snapshot_observed_at":"2026-08-07T10:35:02.120455Z","title":"Olausson, Jeevana Priya Inala, Chenglong Wang, Jianfeng Gao, and Armando Solar-Lezama","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.120455Z"},"links":{"cited_paper":"/paper/2306.09896","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:9709a7c271b1fbb59ba26f4400f38e2852524ee4c833c880b9a42559f342b9a8","observation_id":"ac9e268a-8594-43a4-8285-48859606379a","resolution":{"observed_at":"2026-08-07T10:35:02.120455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14658","last_updated":"2025-01-07T05:37:04Z","snapshot_observed_at":"2026-08-06T03:14:31.781649Z","submitted_at":"2024-02-22T16:06:23Z","title":"OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14658","snapshot_observed_at":"2026-08-07T10:35:02.124225Z","title":"OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.124225Z"},"links":{"cited_paper":"/paper/2402.14658","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:3247c7ce22293e8dfaa9a39d76d71fd0a7d0606f833c8ac79c0f6f0ff0aab686","observation_id":"b1e36e96-768f-4d86-a294-6eddbee9cf53","resolution":{"observed_at":"2026-08-07T10:35:02.124225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.346741Z","title":"SPoC: Search-based Pseudocode to Code","venue":null,"work_id":"e2bb48bf-3747-4083-8c48-a55e67b02bde","year":null},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.127317Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:56207722a1285851ffb596cf5da303c532e2006a049970d9de4b02422b867571","observation_id":"003e6e37-0338-4fdb-989d-6c79e5794682","resolution":{"observed_at":"2026-08-07T10:35:02.350049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11354","last_updated":"2025-04-15T16:23:44Z","snapshot_observed_at":"2026-08-03T03:38:06.953412Z","submitted_at":"2025-04-15T16:23:44Z","title":"Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11354","snapshot_observed_at":"2026-08-07T10:35:02.130547Z","title":"Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.130547Z"},"links":{"cited_paper":"/paper/2504.11354","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:d76033c70ce927bd1bde449400bf404420c2c669ca65942c717f34f616a6a621","observation_id":"141f6732-d71d-414f-a849-015d7191659a","resolution":{"observed_at":"2026-08-07T10:35:02.130547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.336224Z","title":null,"venue":null,"work_id":"874dcd53-1445-4591-9743-8c7a55d12dd4","year":null},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.134377Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:f6e9956f66d84b2ec126244fdbfb8f90bf9265b53d3b783a73d0e978f327a76f","observation_id":"bcb97050-bb2e-477c-914b-4236db4aa6d2","resolution":{"observed_at":"2026-08-07T10:35:02.339445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.324725Z","title":"QwQ-32b: Embracing the power of reinforcement learning, March 2025","venue":null,"work_id":"e1d37750-20d5-4db3-8727-6231d5d5bd8d","year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.138061Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:0c5b6c2ddccabbfb4020d1970f6a8710e3a9367fa520a2f5a75586ed585743c7","observation_id":"80de60c8-3f66-40a9-913c-4d607dae410c","resolution":{"observed_at":"2026-08-07T10:35:02.328705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04548","last_updated":"2025-03-06T15:34:27Z","snapshot_observed_at":"2026-08-07T17:24:22.925386Z","submitted_at":"2025-03-06T15:34:27Z","title":"An Empirical Study on Eliciting and Improving R1-like Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04548","snapshot_observed_at":"2026-08-07T10:35:02.142063Z","title":"An empirical study on eliciting and improving r1-like reasoning models.arXiv preprint arXiv:2503.04548, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.142063Z"},"links":{"cited_paper":"/paper/2503.04548","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:b27d64d02f8203e792a7c663562f8d13ebaa7beeb1faa3ed9a7ada6af63f1da7","observation_id":"91706d69-cc3c-4652-96bf-4e1f55e08da2","resolution":{"observed_at":"2026-08-07T10:35:02.142063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.314795Z","title":null,"venue":null,"work_id":"64800f67-8cfa-4960-9a82-4af86588c2af","year":null},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.146268Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:9401c66c5f3977c451f7fed127bc808f81f7611d9257e0b5e7abda240bd58827","observation_id":"fa1eb5f7-65cb-4f62-883a-f2706f29a21f","resolution":{"observed_at":"2026-08-07T10:35:02.317935Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.303668Z","title":"Category1EnglishName","venue":null,"work_id":"9782f6b0-2870-4c44-a4d9-fe2c131aa5ed","year":2023},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.149902Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:18691ea260f4ede7a798b960501d8faad236908056c6f29d13017a08466dfdf7","observation_id":"49a4dd87-d001-41d3-b3c7-cd905c9f2adf","resolution":{"observed_at":"2026-08-07T10:35:02.307798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T08:53:37.540501Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 2 inbound Pith citation observations for arXiv:2506.04894."}