{"as_of":"2026-08-14T15:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b6d75872f20beb4f0690270be786a919ea7651fae51e541e91511a73524f14b","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T22:23:18.449185Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01715/citation-record","integrity":"/paper/2608.01715/integrity","json":"/paper/2608.01715/citation-record.json","paper":"/paper/2608.01715"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:22.994604Z","title":"ClaudeCode:AnAgenticCodingToolfortheTerminal","venue":null,"work_id":"ddd7a59e-2c0f-4fc9-b5d2-2ba73bc75073","year":2025},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:15.234681Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:5e7c53c7246a836f092e4c2e0ccce02fe74cb386de6b813aac0f935bb07b5e41","observation_id":"1846ae45-7404-433a-90a5-9fe986ed1d3e","resolution":{"observed_at":"2026-08-04T22:23:23.078822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:22.791088Z","title":"Claude Opus 4.8.https://www.anthropic.com/news/claude-opus-4-8, 2026","venue":null,"work_id":"b789ab17-0ab6-47cf-9ac9-aac35291ff63","year":2026},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:15.306558Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:c79abb3231fefd89154be3cfb44b91be00ce32b971bd5301b01fe7144740cfae","observation_id":"79ac956d-89ca-4ca7-974c-917cf0afda1f","resolution":{"observed_at":"2026-08-04T22:23:22.906694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:22.622515Z","title":"Codecontests-o: Powering llms via feedback-driven iterative test case generation","venue":null,"work_id":"aff18744-8bc6-45b6-9c67-78524bb10a5e","year":2026},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:15.380851Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:438b39eb408319275b5db49e722f409b4d5bf29fd5232dafce45a3b77e2b16a4","observation_id":"92bfd690-6947-4750-872d-cef1b6c1b37d","resolution":{"observed_at":"2026-08-04T22:23:22.695487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:15.477265Z","title":"Can llms generate reliable test case generators? a study on competition-level programming problems, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:15.477265Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:036d7e38b2669c3cc44657611d24d34971255070e3a3afa9ec21ae576baf13a1","observation_id":"939ed675-3d3a-49c1-acf7-588c8bbfa030","resolution":{"observed_at":"2026-08-04T22:23:15.477265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:22.420103Z","title":"Codet: Code generation with generated tests","venue":null,"work_id":"20904e79-7e95-4d4e-9bdd-ca7649ebd3c9","year":2023},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:15.533634Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:7e5e2fc3fc8c8ef530492c4d172e5a5d9c06a34dffa7b148bcda7a8cad7d800d","observation_id":"97eda75e-f171-4461-98c0-76e623f6e977","resolution":{"observed_at":"2026-08-04T22:23:22.505709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:22.118298Z","title":null,"venue":null,"work_id":"adc767da-1f8a-45bd-954f-d79c8fa20145","year":2021},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:15.622996Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:e8be19760b70bdb0f8cc9632a8dfe7facaf421b408b4573a18a1ce7ab3359e1a","observation_id":"de222aa3-2388-4437-aac6-16084ac28244","resolution":{"observed_at":"2026-08-04T22:23:22.267756Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:15.713080Z","title":"Deepseek-v4: Towards highly efficient million-token context intelligence, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:15.713080Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:a311e507e13cc2600fff0e10b934aed1605deaf207cd298e07ca9dcbd9e32f5d","observation_id":"e648841f-8d2a-4b32-993b-577b359d78c0","resolution":{"observed_at":"2026-08-04T22:23:15.713080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05710","last_updated":"2025-09-11T02:44:37Z","snapshot_observed_at":"2026-08-09T23:04:14.581301Z","submitted_at":"2025-08-07T07:36:01Z","title":"Klear-CodeTest: Scalable Test Case Generation for Code Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.05710","snapshot_observed_at":"2026-08-04T22:23:15.782639Z","title":"Klear-codetest: Scalable test case generation for code reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:15.782639Z"},"links":{"cited_paper":"/paper/2508.05710","citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:d1363680e91a7ac1d298eda823de135c05e4c589247be92c64553c90f5a03882","observation_id":"58b5e466-6633-4e0a-9054-7ab05254309a","resolution":{"observed_at":"2026-08-04T22:23:15.782639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:21.966620Z","title":"Google Antigravity: An Agentic Development Platform","venue":null,"work_id":"b12e8548-92c1-428e-9202-36b99e848a76","year":2025},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:15.816645Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:b7e40f0c3ad59bb811c54df0a76335989366f816c3e86e4c51c5b0542006ab04","observation_id":"0abba0e1-298c-4178-ab30-239e0db3f0f0","resolution":{"observed_at":"2026-08-04T22:23:22.038791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:21.802287Z","title":"Gemini3.1ProModelCard","venue":null,"work_id":"c054d9fc-1935-4736-9a2f-4c5827742db0","year":2026},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:15.940161Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:f7237fa2a890d28de7bc254fd6141ffe1f81b0bceb8633c03979140f281e67ea","observation_id":"f6f3fe3e-3eb4-4239-ae84-2f2f27991555","resolution":{"observed_at":"2026-08-04T22:23:21.859122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24098","last_updated":"2025-05-30T01:00:34Z","snapshot_observed_at":"2026-08-14T15:23:26.882834Z","submitted_at":"2025-05-30T01:00:34Z","title":"HardTests: Synthesizing High-Quality Test Cases for LLM Coding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24098","snapshot_observed_at":"2026-08-04T22:23:16.109674Z","title":"Hardtests: Synthesizing high-quality test cases for llm coding, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:16.109674Z"},"links":{"cited_paper":"/paper/2505.24098","citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:1c7de259669abdabeee77fd698c08bd9827081e42a3d116e690418562d070f50","observation_id":"0aa7b6c7-458a-4bf8-a924-98bbb9ae9c7b","resolution":{"observed_at":"2026-08-04T22:23:16.109674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15301","last_updated":"2026-05-14T18:15:09Z","snapshot_observed_at":"2026-08-02T11:57:07.030410Z","submitted_at":"2026-05-14T18:15:09Z","title":"Solvita: Enhancing Large Language Models for Competitive Programming via Agentic Evolution","version":1},"cited_work":{"arxiv_id":"2605.15301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.15301","snapshot_observed_at":"2026-08-04T22:23:19.392633Z","title":"Solvita: Enhancing Large Language Models for Competitive Programming via Agentic Evolution","venue":"cs.AI","work_id":"dd4fdbdd-9ad1-4cac-9a9d-ba7e9ad5f56e","year":2026},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:16.216536Z"},"links":{"cited_paper":"/paper/2605.15301","citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:3c2a61072669d71c9c68afc9cfe78f616f15c3339ecb3337b7cd0fd2ca7da7f6","observation_id":"6fc37dcc-076b-4765-98a7-47dcd6345f6f","resolution":{"observed_at":"2026-08-04T22:23:19.467825Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14852","last_updated":"2023-12-27T10:09:18Z","snapshot_observed_at":"2026-08-14T08:53:27.956962Z","submitted_at":"2023-12-22T17:25:42Z","title":"TACO: Topics in Algorithmic COde generation dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14852","snapshot_observed_at":"2026-08-04T22:23:16.315763Z","title":"Taco: Topics in algorithmic code generation dataset, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:16.315763Z"},"links":{"cited_paper":"/paper/2312.14852","citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:cd1ffadaae74cad8e9b0d1037f0f3cd556c85b07834cc1e32620e06ddb3ef245","observation_id":"9f574be9-edea-40d3-847e-17cf1cfa7cc3","resolution":{"observed_at":"2026-08-04T22:23:16.315763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:16.441853Z","title":"Mankowitz, Esme Sutherland Robson, Pushmeet Kohli, Nando de Fre- itas, Koray Kavukcuoglu, and Oriol Vinyals","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:16.441853Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:3574b9909a5228c76396b72d4ce2f40bb3cb2aa7e6c37e771862cd4b4f1a0292","observation_id":"5ec99d1c-a805-4ef5-8760-83e56ad43003","resolution":{"observed_at":"2026-08-04T22:23:16.441853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:21.583856Z","title":"Is your code generated by chatgpt really correct? rigorous evaluation of large language models for code generation","venue":null,"work_id":"15b76a41-b281-4884-915d-9387b0aa3339","year":2023},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:16.555528Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:2ae5bf5ff3f150feeed42a3e1a0d8beb82baf0f6a0e6850f339278295b01eccb","observation_id":"7532c92d-b330-4446-b5c4-453196e95855","resolution":{"observed_at":"2026-08-04T22:23:21.643919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:16.654472Z","title":"Zhang, Zhenpeng Chen, Federica Sarro, Mark Harman, Gang Huang, and Yun Ma","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:16.654472Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:c398ebb3459140d086bbcf332a984b243f93cb3b9585d29bf8f2cfb0b9b06792","observation_id":"8be04a2a-a6ea-4297-8533-3daca015fc5a","resolution":{"observed_at":"2026-08-04T22:23:16.654472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3991.36448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:19.139187Z","title":"Zhang, Federica Sarro, Gang Huang, and Yun Ma","venue":null,"work_id":"522fddcf-e72d-4f57-8a65-d672f4750140","year":2024},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:16.719303Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:e564e3d89964ac05e491b6f206cd7ba7042ebee4e74541350c272ef2b81bc116","observation_id":"67eb9148-7542-43a7-a0d0-979ee25d25fc","resolution":{"observed_at":"2026-08-04T22:23:19.233067Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.20","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Zhang, Mark Harman, Yudong Han, Yun Ma, Yihong Dong, Ge Li, and Gang Huang","venue":null,"work_id":"d6920b39-b981-470a-b0ae-8eeffedbf989","year":2025},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:16.818459Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:dc851ee89f5ca36cb11573cae2c408729981d71e0e8c8b6d32a9ab1d29816ab1","observation_id":"5f22e658-3ee1-47a4-a5da-81400cad444d","resolution":{"observed_at":"2026-08-04T22:23:21.499969Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:21.249344Z","title":"Codex CLI: A Lightweight Coding Agent for the Terminal.https://github.com/openai/ codex, 2025","venue":null,"work_id":"504ad311-9e75-4bb9-9f80-aaaa7a7c3332","year":2025},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:16.969030Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:44c8716b00a7fb403a4e3ca1e09af596a6e2361e3b121d2edd468006f4b14861","observation_id":"831fff94-a9cc-443e-8d17-1ccc07ed16be","resolution":{"observed_at":"2026-08-04T22:23:21.321231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:21.059684Z","title":"GPT-5.4 Thinking System Card","venue":null,"work_id":"5454c8fb-9c14-4c4e-94e3-1bcf859fd6e2","year":2026},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:17.052175Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:a2fb3239817b4660cd6cdbc8172a7b616640e3889575959abd4748df91b2fb34","observation_id":"20ad7ae1-6cac-407b-8069-833dc68f1a39","resolution":{"observed_at":"2026-08-04T22:23:21.133749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:20.861245Z","title":"OpenCode: An Open-Source AI Coding Agent for the Terminal.https:// opencode.ai/, 2025","venue":null,"work_id":"c2c1c415-1ef5-447f-955d-9643f8544d31","year":2025},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:17.143608Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:0a304c32a088b780a8d1f4dd05ac240b6e92949917603242dd49a95fe8c16af9","observation_id":"fca88a36-1f7e-4a88-8f3f-65e5bee16cb5","resolution":{"observed_at":"2026-08-04T22:23:20.976827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:20.658797Z","title":"Kung, Geert Janssen, Wei Zhang, Giacomo Domeniconi, Vladimir Zolotov, Julian Dolby, Jie Chen, Mihir R","venue":null,"work_id":"c2d7d57c-a4d0-427a-9593-aeb617aaeb61","year":2021},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:17.343265Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:cfd0989adde47113493d7862fb659f701f0c1e1e597b780a1c836bfa00288d7e","observation_id":"2f18b3d6-b055-43e6-bb99-258452dcd23b","resolution":{"observed_at":"2026-08-04T22:23:20.722909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:20.444140Z","title":"Codehacker: Automated test case generation for detecting vulnerabilities in competitive programming solutions","venue":null,"work_id":"c858de21-44df-40a4-b259-e91323d660f8","year":2026},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:17.443071Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:7313e4844493778908f89ab25d54f1869f66e05398520b2da6877dc84a05feb2","observation_id":"b9b3f4e4-d1f6-494b-b976-2d7a6afdb3db","resolution":{"observed_at":"2026-08-04T22:23:20.539913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2025/861","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Logicase: Effective test case generation from logicaldescriptionincompetitiveprogramming","venue":null,"work_id":"364c7f82-24a4-4191-af7b-006e175e1772","year":2025},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:17.553688Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:ac53c156625568926584a9cbede6ff7eb4804f7eb57d2931df1c02db4c189025","observation_id":"9dd1da5b-34e4-44e7-8423-2d06e28ba81e","resolution":{"observed_at":"2026-08-04T22:23:18.798287Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:20.278928Z","title":"Co-evolving LLM coder and unit tester via reinforcement learning","venue":null,"work_id":"1c6b5d00-a3fc-46ab-9376-cbbfd2d4a22b","year":2025},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:17.676119Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:2fbd8963c08b74a82c2afc8c04fdbcc09d8bc0342d5576bf245c806aa34ab8f7","observation_id":"00a3011a-cb9a-470a-a6cf-ca323d0eb158","resolution":{"observed_at":"2026-08-04T22:23:20.357664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:20.124377Z","title":"Codecontests+: High-quality test case generation for competitive programming.Conference on Empirical Methods in Natural Language Processing,","venue":null,"work_id":"019991fc-9a35-41d4-98c2-416e6a10a00d","year":null},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:17.788798Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:832788bac8270e44935be6d2875f16247b875e15157960854fc425092c56efba","observation_id":"3ff0b0a6-083d-4b85-8d95-9008061ac267","resolution":{"observed_at":"2026-08-04T22:23:20.164460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.12864","last_updated":"2026-06-11T03:48:18Z","snapshot_observed_at":"2026-08-09T16:38:25.348225Z","submitted_at":"2026-06-11T03:48:18Z","title":"Beyond Problem Solving: UOJ-Bench for Evaluating Code Generation, Hacking, and Repair in Competitive Programming","version":1},"cited_work":{"arxiv_id":"2606.12864","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.12864","snapshot_observed_at":"2026-08-04T22:23:18.915548Z","title":"Beyond Problem Solving: UOJ-Bench for Evaluating Code Generation, Hacking, and Repair in Competitive Programming","venue":"cs.SE","work_id":"7d2deef3-debe-4b18-90b0-afb35a2e50fd","year":2026},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:17.976138Z"},"links":{"cited_paper":"/paper/2606.12864","citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:3f71bf678b6ad528ad2d94659a6304e96a5b4fc3f027d23de9882730f72b15ed","observation_id":"d890f4df-2eee-4a47-850c-4faf06fd4129","resolution":{"observed_at":"2026-08-04T22:23:19.019371Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:19.935623Z","title":"Jimenez, Alexander Wettig, Kilian Lieret, Shunyu Yao, Karthik Narasimhan, and Ofir Press","venue":null,"work_id":"1db16c99-32cd-4560-b484-3a4864aa3b2c","year":2024},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:18.093451Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:d90c4661b2c5bb7a4a4ca7085fe02cca3cab707e23aae3710b11470a5a2ad502","observation_id":"6b1edaaa-6fd5-4798-9007-adf871dfdb02","resolution":{"observed_at":"2026-08-04T22:23:20.033400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12278","last_updated":"2025-06-13T23:56:17Z","snapshot_observed_at":"2026-08-10T22:43:56.916807Z","submitted_at":"2025-06-13T23:56:17Z","title":"Can LLMs Generate High-Quality Test Cases for Algorithm Problems? TestCase-Eval: A Systematic Evaluation of Fault Coverage and Exposure","version":1},"cited_work":{"arxiv_id":"2506.12278","doi":"10.48550/arxiv.2506.12278","metadata_source":"pith","pith_arxiv_id":"2506.12278","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Can LLMs Generate High-Quality Test Cases for Algorithm Problems? TestCase-Eval: A Systematic Evaluation of Fault Coverage and Exposure","venue":"cs.SE","work_id":"cecd1cdb-d063-49cd-9ed5-edeef953eec3","year":2025},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:18.237307Z"},"links":{"cited_paper":"/paper/2506.12278","citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:5deb744142617c963efffb3450a699aae6162c76c40578cb15e565d9fb021f16","observation_id":"e45ec79c-5879-4031-a6ac-3a2f2c27ff7c","resolution":{"observed_at":"2026-08-04T22:23:18.639334Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:19.656542Z","title":"Themis: Automated constraint- aware test synthesis framework for code reinforcement learning","venue":null,"work_id":"1d7f24b8-9afb-4edb-96e6-081e7f274965","year":2026},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:18.352497Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:c4fc8a700992322a71733a237493a84770072ba908f56315636cc939fb63e799","observation_id":"02ad301b-70ce-4a63-b2f6-8f59e520555e","resolution":{"observed_at":"2026-08-04T22:23:19.748134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:23:18.449185Z","title":"Autocode: Llms as problem setters for competitive programming, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:18.449185Z"},"links":{"citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:80bd2065e65723de25289d9bfb3bcb02cc432774fb8a9989c93bd087e714dc8f","observation_id":"47504924-afc0-4e3e-914d-a7200f344fd5","resolution":{"observed_at":"2026-08-04T22:23:18.449185Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05817","last_updated":"2025-06-06T07:29:01Z","snapshot_observed_at":"2026-08-09T19:50:40.350535Z","submitted_at":"2025-06-06T07:29:01Z","title":"CodeContests+: High-Quality Test Case Generation for Competitive Programming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05817","snapshot_observed_at":"2026-08-04T22:23:17.906054Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T22:23:17.906054Z"},"links":{"cited_paper":"/paper/2506.05817","citing_paper":"/paper/2608.01715"},"observation_digest":"sha256:9b72f1a4fd3fe375c252e9a5b0ca9263926d80de845dc9cbcb96047afd1c2186","observation_id":"79d8b6c6-2870-4d46-87f0-ef8c806f7fcb","resolution":{"observed_at":"2026-08-04T22:23:17.906054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01715","last_updated":"2026-08-03T05:24:03Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-11T02:26:46.409908Z","submitted_at":"2026-08-03T05:24:03Z","title":"Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":9,"verified_exact":5,"verified_fuzzy":16},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2608.01715."}