{"as_of":"2026-08-08T08:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5b03188301e8e55cdc8e7159fa56bfad24c2b21a1c3deb9a3cf8f353f7d2940a","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:51:08.296878Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:39:07.157245Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T04:06:35.135954Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-08-05T10:39:07.157245Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-08T03:54:26.940042Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":192,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:07.157245Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:86a2095d7e46b9ef1314d821685a9f4b614abf2d18a11b5c106e2ff0d1dc7d02","observation_id":"18593e05-7b44-4af2-b289-62364271ef2b","resolution":{"observed_at":"2026-08-05T10:39:07.157245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":"2506.06971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-07-02T04:06:35.135954Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":"7a69171b-abe9-4a44-a099-2ba8d26e8210","year":2025},"citing_paper":{"arxiv_id":"2512.05929","last_updated":"2026-06-29T18:18:24Z","snapshot_observed_at":"2026-08-03T18:19:06.255338Z","submitted_at":"2025-12-05T18:12:21Z","title":"LLM Harms: A Taxonomy and Discussion","version":2},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-05-17T00:29:07.951709Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2512.05929"},"observation_digest":"sha256:5dc0c00f6719804c58298b3eca55910871127aab6ddd5a45a062635c7027482a","observation_id":"8d421516-874e-474e-9b4e-89c13f29d2e7","resolution":{"observed_at":"2026-05-17T00:31:24.747791Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-08-03T18:19:19.974924Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.05929","last_updated":"2026-06-29T18:18:24Z","snapshot_observed_at":"2026-08-03T18:19:06.255338Z","submitted_at":"2025-12-05T18:12:21Z","title":"LLM Harms: A Taxonomy and Discussion","version":4},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-03T18:19:19.974924Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2512.05929"},"observation_digest":"sha256:60c650beb80e5c018241ff9602ffe6d099aa7e66d2b8482fa302ce6650832f4d","observation_id":"f41b8102-6318-49a8-ad9c-8d91cff7844a","resolution":{"observed_at":"2026-08-03T18:19:19.974924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":"2506.06971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-07-02T04:06:35.135954Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":"7a69171b-abe9-4a44-a099-2ba8d26e8210","year":2025},"citing_paper":{"arxiv_id":"2603.03332","last_updated":"2026-04-16T23:41:41Z","snapshot_observed_at":"2026-08-04T02:21:24.392691Z","submitted_at":"2026-02-11T03:11:30Z","title":"Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T03:43:18.987241Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2603.03332"},"observation_digest":"sha256:4a32232e846ad86e8834181c8d711f5e13491e304e4125630700bf1d9ac71a55","observation_id":"dc34b590-72f1-4af7-ad4c-22d199aaba51","resolution":{"observed_at":"2026-05-16T03:47:15.321963Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":"2506.06971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-07-02T04:06:35.135954Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":"7a69171b-abe9-4a44-a099-2ba8d26e8210","year":2025},"citing_paper":{"arxiv_id":"2604.02776","last_updated":"2026-04-03T06:37:51Z","snapshot_observed_at":"2026-08-02T13:25:19.726180Z","submitted_at":"2026-04-03T06:37:51Z","title":"Evaluating the Environmental Impact of using SLMs and Prompt Engineering for Code Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T20:12:12.283350Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2604.02776"},"observation_digest":"sha256:7faecc2baac4797f2ad218fe06b486054708db2215c1eaf7f877fe6c7670ce28","observation_id":"68590926-ccbb-4007-b745-06c1472dd8c3","resolution":{"observed_at":"2026-05-13T20:13:13.226797Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":"2506.06971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-07-02T04:06:35.135954Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":"7a69171b-abe9-4a44-a099-2ba8d26e8210","year":2025},"citing_paper":{"arxiv_id":"2604.24712","last_updated":"2026-04-27T17:21:09Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:21:09Z","title":"When Prompt Under-Specification Improves Code Correctness: An Exploratory Study of Prompt Wording and Structure Effects on LLM-Based Code Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T03:00:26.137401Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2604.24712"},"observation_digest":"sha256:e0c7f102075fd92dfcb1c9bfd3ad00a101ab1ff7d0a12b38bf9a73ea3b9137a2","observation_id":"ae55b03f-1380-4ca0-b2a9-940c6a69186e","resolution":{"observed_at":"2026-05-11T22:17:08.280584Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":"2506.06971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-07-02T04:06:35.135954Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":"7a69171b-abe9-4a44-a099-2ba8d26e8210","year":2025},"citing_paper":{"arxiv_id":"2604.25247","last_updated":"2026-04-28T05:52:57Z","snapshot_observed_at":"2026-07-06T23:11:07.254460Z","submitted_at":"2026-04-28T05:52:57Z","title":"R-CoT: A Reasoning-Layer Watermark via Redundant Chain-of-Thought in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T15:54:22.189376Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2604.25247"},"observation_digest":"sha256:57413b952dcce735210066a1db5cb3f912ba31be7cee67cc0e7965a7e1dccb21","observation_id":"8b0bd2e4-a2e6-4695-abf1-b7d4f4f748d9","resolution":{"observed_at":"2026-05-12T00:01:16.603177Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"cited_work":{"arxiv_id":"2506.06971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06971","snapshot_observed_at":"2026-07-02T04:06:35.135954Z","title":"Chain -of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","venue":null,"work_id":"7a69171b-abe9-4a44-a099-2ba8d26e8210","year":2025},"citing_paper":{"arxiv_id":"2606.03606","last_updated":"2026-06-03T12:40:36Z","snapshot_observed_at":"2026-08-05T13:58:58.657681Z","submitted_at":"2026-06-02T13:09:44Z","title":"Testing LLM Arithmetic Reasoning Generalization with Automatic Numeric-Remapping Attacks","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T09:27:30.923556Z"},"links":{"cited_paper":"/paper/2506.06971","citing_paper":"/paper/2606.03606"},"observation_digest":"sha256:5739c3df925c1556efb733a27704ff6de163ead81dea00cd55c651026cf15231","observation_id":"1c751d0a-ac3c-4453-a69f-9c738afe5221","resolution":{"observed_at":"2026-07-02T04:06:35.137777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.06971/citation-record","integrity":"/paper/2506.06971/integrity","json":"/paper/2506.06971/citation-record.json","paper":"/paper/2506.06971"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.145300Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.145300Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:b5af5fe6f88f1468eac1fd771d02cfca3b19ce24161a7cd954c5d8f4e33ba786","observation_id":"1cc80f4a-1b19-4098-a200-3c42fdac6bd7","resolution":{"observed_at":"2026-08-07T05:51:08.145300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.150604Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.150604Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:7268f30ae1611c12e6b80f3aec1c98cde98908ac732e1d1d60714360678f68d6","observation_id":"25a45a19-72f3-4669-98b4-b3c5bfe7d344","resolution":{"observed_at":"2026-08-07T05:51:08.150604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.996898Z","title":"Claude 3.5 sonnet model card addendum","venue":null,"work_id":"72f2c28e-d616-4d4c-b10b-efd89edad05d","year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.155720Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:6274a06783d8eb0d35e427bc7dc40e6c6e317ba3e67f677af8412cdd0df251a8","observation_id":"4576ad32-3c13-4e05-bd36-f65481606d51","resolution":{"observed_at":"2026-08-07T05:51:09.001469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T05:51:08.160153Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.160153Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:9c447614cae92d13ec3b1a31b3b2f79242e30cc81b3bf101b9db8f2502cbe8b7","observation_id":"d5204a0a-3cb1-43c1-a339-9aadcfabc6e1","resolution":{"observed_at":"2026-08-07T05:51:08.160153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2306.04761","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.880793Z","title":null,"venue":null,"work_id":"11120cd6-a2eb-4dc3-93cc-ce74f264f799","year":2023},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.165145Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:5623fb6bd63c689dfaddb8d7e21fd3b07ce91653f0724849359b54e8a1a66699","observation_id":"8024a898-52c8-4871-8dda-8812174d5f89","resolution":{"observed_at":"2026-08-07T05:51:08.887769Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.982387Z","title":"B., Mann, B., Ryder, N., Subbiah, M., Kaplan, J., Dhariwal, P., et al","venue":null,"work_id":"b3e9c37e-5dd8-4f56-a059-b829b1c0bf17","year":2020},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.169687Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:2814c0d588da0ea79de43018c7d1ce391142058b232c4f3e06ac5048e0464d23","observation_id":"6f2d7cb4-bf2f-4855-a711-9fba19f45d9b","resolution":{"observed_at":"2026-08-07T05:51:08.987211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.174079Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.174079Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:d8c9be1eb0ec64c2ab6cf103429d42ad299e4030f3cc38098deb51c5de5495f4","observation_id":"a05ed8dd-349a-41e4-9ac3-3f8917fc2b31","resolution":{"observed_at":"2026-08-07T05:51:08.174079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04322","last_updated":"2025-08-02T02:38:57Z","snapshot_observed_at":"2026-08-02T21:10:23.313326Z","submitted_at":"2025-02-06T18:59:02Z","title":"Speak Easy: Eliciting Harmful Jailbreaks from LLMs with Simple Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04322","snapshot_observed_at":"2026-08-07T05:51:08.178292Z","title":"S., Ri, N., Xiao, Y., and Ghassemi, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.178292Z"},"links":{"cited_paper":"/paper/2502.04322","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:b015cef1f8fb9e58e3da3a95d5814a043b5fa7026c8ebe81e02f2a06aef43317","observation_id":"f3be7efb-d35d-43b4-9c65-2d8fecfd881a","resolution":{"observed_at":"2026-08-07T05:51:08.178292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T04:13:14.044604Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T05:51:08.184087Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.184087Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:60cf89d6375035529a0432e28270e8cd11bca236ad45e059747b7351d0578d04","observation_id":"5a20a6cb-b99a-4df5-a395-290fbf69998a","resolution":{"observed_at":"2026-08-07T05:51:08.184087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12588","snapshot_observed_at":"2026-08-07T05:51:08.188690Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.188690Z"},"links":{"cited_paper":"/paper/2211.12588","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:8f36a714e12150114c43b4af11c173442707a2ca619168e71250d11376723543","observation_id":"166905c1-58f0-405c-8995-a48634ab6de8","resolution":{"observed_at":"2026-08-07T05:51:08.188690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-07T05:51:08.193698Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.193698Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:fc0583669a1ed7ee79abc83901065b2ad725d0a1e628cbb18e3a724d2a3026a0","observation_id":"406460a9-b7f9-46ec-82de-f6e95517a595","resolution":{"observed_at":"2026-08-07T05:51:08.193698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.967060Z","title":null,"venue":null,"work_id":"7d9edf9f-842b-4327-83bd-78f7ebab839e","year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.198459Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:0d5efce3572a439be7f153040da205fd95e0a61f57f11587268e8fa9c325cacb","observation_id":"ea126601-bc10-4287-81be-f3a96c7854a8","resolution":{"observed_at":"2026-08-07T05:51:08.971841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.202745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.202745Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:94eb160701e473d22e948b61a97c436a60e425243df1de037b2b0a73b12abdd5","observation_id":"f4ff5f4c-af3d-44fb-afe9-397637c5d5a6","resolution":{"observed_at":"2026-08-07T05:51:08.202745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05345","last_updated":"2024-11-08T05:54:05Z","snapshot_observed_at":"2026-08-02T01:32:35.090088Z","submitted_at":"2024-11-08T05:54:05Z","title":"Reasoning Robustness of LLMs to Adversarial Typographical Errors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05345","snapshot_observed_at":"2026-08-07T05:51:08.207227Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.207227Z"},"links":{"cited_paper":"/paper/2411.05345","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:ee3c4210f935712647d73fa33eb67b78938db7195ef144428b3264d485a42fdf","observation_id":"17441521-0ea3-466a-916a-3477adb86b6a","resolution":{"observed_at":"2026-08-07T05:51:08.207227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.07919","last_updated":"2023-09-12T15:08:46Z","snapshot_observed_at":"2026-07-06T14:31:03.189108Z","submitted_at":"2022-12-15T15:52:39Z","title":"ROSCOE: A Suite of Metrics for Scoring Step-by-Step Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.07919","snapshot_observed_at":"2026-08-07T05:51:08.212502Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.212502Z"},"links":{"cited_paper":"/paper/2212.07919","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:3a74608c3442c3bb57d1eef72ad7c906a7dc40b8e2ea6ad9b26b4bb1e343d000","observation_id":"fb7d36f6-e76c-4daa-83bb-36b16ce378b4","resolution":{"observed_at":"2026-08-07T05:51:08.212502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T05:51:08.217351Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.217351Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:4961b363ec11bdde6b1cc8e874bb9fc37cab30fbe66b2a4ac8805f718cb9ac36","observation_id":"e789521a-ec05-4200-9790-db0e2307b013","resolution":{"observed_at":"2026-08-07T05:51:08.217351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-07T05:51:08.222098Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.222098Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:1991102dca42cd1054e8bd753d6b0144ddded80329e401dc054d5cf5a8414f04","observation_id":"d9d8ee22-e5c0-433d-8521-cbf204bd4b19","resolution":{"observed_at":"2026-08-07T05:51:08.222098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00515","last_updated":"2024-11-10T22:02:27Z","snapshot_observed_at":"2026-07-29T20:40:25.374189Z","submitted_at":"2024-06-01T17:48:15Z","title":"A Survey on Large Language Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00515","snapshot_observed_at":"2026-08-07T05:51:08.226705Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.226705Z"},"links":{"cited_paper":"/paper/2406.00515","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:142c376c21dab3c69f201181ae2c9577c0cde371dce37067e9483c0deb639c66","observation_id":"269a8631-4d0f-4694-972b-72d75345b3b0","resolution":{"observed_at":"2026-08-07T05:51:08.226705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.951351Z","title":"Introducing llama 3.1: Our most capable models to date","venue":null,"work_id":"65460910-7511-442b-a2f2-2cfdf3956ad2","year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.232645Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:ee935ed565aa7d0f159d99a75bbdad3fc524763e1e3c9816530957596370ed30","observation_id":"d56653d6-2a94-4d38-a31a-07e357cd0ac7","resolution":{"observed_at":"2026-08-07T05:51:08.956039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-07T05:51:08.236834Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.236834Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:7af6fa933e240a26370779e7ce98d5886a4798e8beb8e82358bb5ada3383d50c","observation_id":"3af16814-659a-4225-ae08-783fd29db0d6","resolution":{"observed_at":"2026-08-07T05:51:08.236834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01869","last_updated":"2024-08-06T11:58:53Z","snapshot_observed_at":"2026-08-04T13:02:37.475538Z","submitted_at":"2024-04-02T11:46:31Z","title":"Beyond Accuracy: Evaluating the Reasoning Behavior of Large Language Models -- A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01869","snapshot_observed_at":"2026-08-07T05:51:08.241334Z","title":"and Plank, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.241334Z"},"links":{"cited_paper":"/paper/2404.01869","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:b653ff46efe3f5b52026e3dac94968eee19ceb7a11f6305dc6f24e0dde016ad2","observation_id":"5eae57af-4b47-48db-ac84-34593590a22b","resolution":{"observed_at":"2026-08-07T05:51:08.241334Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19730","last_updated":"2025-04-28T12:28:55Z","snapshot_observed_at":"2026-08-07T15:58:37.164745Z","submitted_at":"2025-04-28T12:28:55Z","title":"Evaluate-and-Purify: Fortifying Code Language Models Against Adversarial Attacks Using LLM-as-a-Judge","version":1},"cited_work":{"arxiv_id":"2504.19730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.19730","snapshot_observed_at":"2026-08-07T05:51:08.543165Z","title":"Evaluate-and-Purify: Fortifying Code Language Models Against Adversarial Attacks Using LLM-as-a-Judge","venue":"cs.SE","work_id":"1398215e-cc5b-42c6-8d3b-6ff6a38f91bb","year":2025},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.245901Z"},"links":{"cited_paper":"/paper/2504.19730","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:abd33bdafc5f417a7bcfd56a82c31486abac202a25848c6055f59cf820e38efb","observation_id":"616200a2-78ed-404f-a347-e7e31ee6f17c","resolution":{"observed_at":"2026-08-07T05:51:08.549047Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.936774Z","title":"Gpt-4 technical report","venue":null,"work_id":"67f5dfb2-bfee-46e7-8917-10dbf2f0d066","year":2023},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.250595Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:a5afd7f2ddefc05845b6a682527f6871bfda77e0dd71867d37f3499a21e52eb1","observation_id":"e31c552c-5ad9-4857-94ed-d91255800a02","resolution":{"observed_at":"2026-08-07T05:51:08.941207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10703","last_updated":"2023-11-30T23:33:07Z","snapshot_observed_at":"2026-08-04T12:27:12.584527Z","submitted_at":"2023-04-21T02:19:06Z","title":"ReCEval: Evaluating Reasoning Chains via Correctness and Informativeness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10703","snapshot_observed_at":"2026-08-07T05:51:08.254881Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.254881Z"},"links":{"cited_paper":"/paper/2304.10703","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:2e72d1af2b706ae6857acd9f21d496d9b04ac478035f495bf5d7b440425c9609","observation_id":"7d6bf28a-8846-4d2c-a4c9-afa79093e908","resolution":{"observed_at":"2026-08-07T05:51:08.254881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19103","last_updated":"2024-05-29T14:07:44Z","snapshot_observed_at":"2026-07-06T18:22:01.301152Z","submitted_at":"2024-05-29T14:07:44Z","title":"Voice Jailbreak Attacks Against GPT-4o","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19103","snapshot_observed_at":"2026-08-07T05:51:08.260580Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.260580Z"},"links":{"cited_paper":"/paper/2405.19103","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:619b95fba4ce5b163a45134b89951c8119bfa76dbbe955623fbd38cabacabec1","observation_id":"965cd3c1-0dec-41e0-a7f7-cdc7e40210b8","resolution":{"observed_at":"2026-08-07T05:51:08.260580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.13115","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.492551Z","title":null,"venue":null,"work_id":"0d1682e1-68b8-4f03-878e-c38dadc5d09a","year":2025},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.265077Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:30ac568f69c0077b9f855033e126f7ee19ccf50928c3e743f69693026936a879","observation_id":"2b9881c2-b2a5-46d4-901b-0e920d6cc20b","resolution":{"observed_at":"2026-08-07T05:51:08.500557Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02184","last_updated":"2024-10-03T03:58:03Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T03:58:03Z","title":"CodeJudge: Evaluating Code Generation with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02184","snapshot_observed_at":"2026-08-07T05:51:08.269551Z","title":"and Zhang, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.269551Z"},"links":{"cited_paper":"/paper/2410.02184","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:2a6f9c7c20ddc42f65c854879f320a516421598d2cef4d2aa402e7f1f4deca1a","observation_id":"20ac46b0-20b6-4df8-954f-b7a22e8fb6c9","resolution":{"observed_at":"2026-08-07T05:51:08.269551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04091","last_updated":"2023-05-26T07:06:48Z","snapshot_observed_at":"2026-07-06T15:24:07.662207Z","submitted_at":"2023-05-06T16:34:37Z","title":"Plan-and-Solve Prompting: Improving Zero-Shot Chain-of-Thought Reasoning by Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04091","snapshot_observed_at":"2026-08-07T05:51:08.274247Z","title":"K.-W., and Lim, E.-P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.274247Z"},"links":{"cited_paper":"/paper/2305.04091","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:6778301814d3bd9632df2e597dea348ace23765d38d7ad2c6027be652b54c54c","observation_id":"ba98e327-84fd-4114-8df8-c1c236ec837e","resolution":{"observed_at":"2026-08-07T05:51:08.274247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.279011Z","title":"V., Zhou, D., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.279011Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:7d3c35c9b17bfee4f6d885c765c78ae83bcd6ee167cd41dc5fb27fba3ea9b75f","observation_id":"423aab1f-ee95-4121-aaf2-efe02d4cb7ba","resolution":{"observed_at":"2026-08-07T05:51:08.279011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04730","last_updated":"2023-12-12T19:42:11Z","snapshot_observed_at":"2026-07-06T16:58:36.087327Z","submitted_at":"2023-12-07T22:19:06Z","title":"DeceptPrompt: Exploiting LLM-driven Code Generation via Adversarial Natural Language Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04730","snapshot_observed_at":"2026-08-07T05:51:08.283547Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.283547Z"},"links":{"cited_paper":"/paper/2312.04730","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:af887a9ccb792deed05efdb6751c0a9ca501b133ee351edf359620bb64247733","observation_id":"937e60db-bb68-4755-864e-e46940ef7d65","resolution":{"observed_at":"2026-08-07T05:51:08.283547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20545","last_updated":"2025-07-08T09:46:27Z","snapshot_observed_at":"2026-08-07T07:24:17.397326Z","submitted_at":"2024-12-29T18:34:10Z","title":"The Impact of Prompt Programming on Function-Level Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20545","snapshot_observed_at":"2026-08-07T05:51:08.288204Z","title":"V., and Xiong, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.288204Z"},"links":{"cited_paper":"/paper/2412.20545","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:891772b8c7dfa7e1f11f1761e660f46af58f9ff266bb900084f9c83907c60ea8","observation_id":"58279d8c-98e0-4b95-b414-cb3b8de897e8","resolution":{"observed_at":"2026-08-07T05:51:08.288204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:08.913356Z","title":null,"venue":null,"work_id":"ef76ea49-3596-4d3e-a9d3-caa6aff3e159","year":2024},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.292601Z"},"links":{"citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:8ff4c9a8b950429fe592b36285a11aa2a8f543ae726438c7b1ca939acb790e61","observation_id":"5cc1ba21-d991-4b98-b340-126cd5f76231","resolution":{"observed_at":"2026-08-07T05:51:08.918066Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15341","last_updated":"2025-03-19T15:40:45Z","snapshot_observed_at":"2026-08-07T16:51:34.078217Z","submitted_at":"2025-03-19T15:40:45Z","title":"Uncertainty-Guided Chain-of-Thought for Code Generation with LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15341","snapshot_observed_at":"2026-08-07T05:51:08.296878Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:08.296878Z"},"links":{"cited_paper":"/paper/2503.15341","citing_paper":"/paper/2506.06971"},"observation_digest":"sha256:9f730cfa62a06aa085588c24a15660b30b23519a8936a982efa9b086fc1806db","observation_id":"eba1995d-3f9b-43be-9282-c8fcc94267ad","resolution":{"observed_at":"2026-08-07T05:51:08.296878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06971","last_updated":"2025-06-12T14:47:31Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T07:20:17.397323Z","submitted_at":"2025-06-08T02:43:46Z","title":"Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":3,"verified_fuzzy":4},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 8 inbound Pith citation observations for arXiv:2506.06971."}