{"as_of":"2026-08-13T02:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:527abbc48042362594cd12e5c6a1a6eae37e9c1f759ac58dbff5c424f13529a7","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-24T02:19:23.135463Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:35:26.462971Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-11T17:26:04.804438Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01535","snapshot_observed_at":"2026-08-12T13:35:26.462971Z","title":"why should i trust you?","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.07781","last_updated":"2024-11-25T06:54:47Z","snapshot_observed_at":"2026-08-12T13:28:51.506274Z","submitted_at":"2024-11-25T06:54:47Z","title":"Can LLMs faithfully generate their layperson-understandable 'self'?: A Case Study in High-Stakes Domains","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:35:26.462971Z"},"links":{"cited_paper":"/paper/2404.01535","citing_paper":"/paper/2412.07781"},"observation_digest":"sha256:a7eaba60b0ed4b6fcd0a50a1a555844ab262257173356c637d80fb14dec58cdc","observation_id":"61406e0d-cd5e-4474-bc89-0a68d815bc69","resolution":{"observed_at":"2026-08-12T13:35:26.462971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"cited_work":{"arxiv_id":"2404.01535","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.01535","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","venue":"cs.SE","work_id":"ac694df8-b063-4129-ae50-eb4e9cc59a5c","year":2024},"citing_paper":{"arxiv_id":"2605.05267","last_updated":"2026-05-06T09:38:31Z","snapshot_observed_at":"2026-08-04T17:41:12.164736Z","submitted_at":"2026-05-06T09:38:31Z","title":"Bridging Generation and Training: A Systematic Review of Quality Issues in LLMs for Code","version":1},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-05-08T17:37:51.790000Z"},"links":{"cited_paper":"/paper/2404.01535","citing_paper":"/paper/2605.05267"},"observation_digest":"sha256:440d5ecdf4cfd83858528f2e0c9a376178a7c97b711aafadb2c06c793ad5ee94","observation_id":"207ffcd3-351d-4add-811e-248aca4a6eb2","resolution":{"observed_at":"2026-05-11T17:26:04.807919Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2404.01535/citation-record","integrity":"/paper/2404.01535/integrity","json":"/paper/2404.01535/citation-record.json","paper":"/paper/2404.01535"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.13010","last_updated":"2024-05-24T11:47:24Z","snapshot_observed_at":"2026-07-06T17:05:56.282078Z","submitted_at":"2023-12-20T13:22:41Z","title":"AgentCoder: Multi-Agent-based Code Generation with Iterative Testing and Optimisation","version":3},"cited_work":{"arxiv_id":"2312.13010","doi":"10.48550/arxiv.2312.13010","metadata_source":"pith","pith_arxiv_id":"2312.13010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AgentCoder: Multi-Agent-based Code Generation with Iterative Testing and Optimisation","venue":"cs.CL","work_id":"a59b2f13-e7d4-4d8b-bffd-504f2417da02","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2312.13010","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:a30fd3c0deb7eb5ac690411b25fd5ab748defa0dcdd2746416798a46d3cefa61","observation_id":"8c6233f9-62c9-4ab1-9e52-2edf537f0b41","resolution":{"observed_at":"2026-05-24T02:23:46.140208Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An empirical study of the code generation of safety-critical software using llms","venue":null,"work_id":"d5292ed3-3db3-4cb7-a4df-2bc38152972a","year":2024},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:7613d8ac93410f04030381d65e218e5d397ce1c730d702a6835c3d53dc6470dd","observation_id":"d1783f87-b459-4b56-b443-538823ccd140","resolution":{"observed_at":"2026-05-24T02:58:48.429631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring early adopters’ perceptions of chatgpt as a code generation tool","venue":null,"work_id":"d0ffd7c1-9243-4e00-92af-4d9c0d8a1ad3","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:353e565963550076dc415eb07fc8adbf0a22a5f834189860272a00a64593bb22","observation_id":"8692cacc-1bc5-487c-98e2-1df0a9dfe96c","resolution":{"observed_at":"2026-05-24T02:58:48.450089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ai2: Safety and robustness certification of neural networks with abstract interpretation","venue":null,"work_id":"9bfce78d-6bc8-45d3-a089-e309ee345796","year":2018},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:98f54b42f281f83afdb6b1f0edc098bc94e722ce09dc70983e3a136bc5b59b2f","observation_id":"a707159b-4cc7-41d6-8d25-1b95998c4b70","resolution":{"observed_at":"2026-05-24T02:58:48.447026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chatgpt for programming numerical methods","venue":null,"work_id":"a6c3f48d-56fc-4ee5-bda4-62667515b495","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:a6ac55a03111b85fb47b63e6395f3c2eee738e0e2ef9fe669986f3a05c26df9d","observation_id":"7722fda5-815f-4ef7-b811-2d78240e8f20","resolution":{"observed_at":"2026-05-24T02:58:48.432558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03533","last_updated":"2023-11-11T21:15:19Z","snapshot_observed_at":"2026-08-03T19:08:11.820438Z","submitted_at":"2023-10-05T13:33:26Z","title":"Large Language Models for Software Engineering: Survey and Open Problems","version":4},"cited_work":{"arxiv_id":"2310.03533","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.03533","snapshot_observed_at":"2026-07-11T03:27:46.278502Z","title":"Large language models for software engineering: Survey and open problems","venue":"cs.SE","work_id":"21a62a32-d973-4db1-bdce-3231d2b9698a","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2310.03533","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:5e501f35ae80e5564cff246e9dcad2f2291d7282b6e2d1a2a86066f2de1c1e18","observation_id":"d3a4a5af-fdf4-48af-801f-d4e862b8dae6","resolution":{"observed_at":"2026-05-24T02:23:46.164298Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d8c3619d-e58c-4a96-b27d-19b84476b6ac","year":2024},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:50b87910443bbcb5a999bba08f42cf87e2ffc55de8e8f6bf7e32e447f6b703b8","observation_id":"8a7b00a2-b9be-43c6-8465-be36e653abe3","resolution":{"observed_at":"2026-05-24T02:58:48.437468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"68bce409-f760-4954-afb0-1ed6c81732db","year":2024},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:7792936eb8df5b368bdc56d44937b41a3dc9a286ef2681ddb16a5a21f872ba3f","observation_id":"61e71a6b-bfbe-457b-aa8a-681fe11a86cb","resolution":{"observed_at":"2026-05-24T02:58:48.455266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gpt-4 technical report","venue":null,"work_id":"be9bca66-ef19-4872-906d-b032e35ddb79","year":2024},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:0ee0438d32b20fe8e12c546c151f31ca44a7dbc047a2a9dff70291a73ded2ea6","observation_id":"af9f927d-f35f-4b1f-b620-8f524c2121fb","resolution":{"observed_at":"2026-05-24T02:58:48.443796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:434fd9376c3f4e6161991f273e4b707c60aae230123598e77ee7fa31661c7542","observation_id":"e8b9e1a8-b2e7-43ed-85cb-27d49b46c16f","resolution":{"observed_at":"2026-05-24T02:23:46.128748Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Competition- level code generation with alphacode","venue":null,"work_id":"b2f87d9e-dc80-4bb7-8036-fd3fecab0ceb","year":2022},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:aec436cba523ffcd04ad2d0dcbbc0b47ddfa439931b97102c726528693238cd9","observation_id":"a96cf442-b48b-4a27-a6c0-a95915d60308","resolution":{"observed_at":"2026-05-24T02:58:48.440726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13474","last_updated":"2023-02-27T21:26:48Z","snapshot_observed_at":"2026-07-06T12:52:16.992962Z","submitted_at":"2022-03-25T06:55:15Z","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","version":5},"cited_work":{"arxiv_id":"2203.13474","doi":"10.48550/arxiv.2203.13474","metadata_source":"pith","pith_arxiv_id":"2203.13474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","venue":"cs.LG","work_id":"892a192d-205a-4079-a807-00d7874b392e","year":2022},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2203.13474","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:4b1db6e0e1e77ff7f87392832c3d1ad8600bc414eb50c6646bd0820fff026d50","observation_id":"37a569f8-87cc-4f6e-93e0-9c9d5b54aa8e","resolution":{"observed_at":"2026-05-24T02:23:46.169645Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving chatgpt prompt for code generation","venue":null,"work_id":"c1ffa099-9919-4898-83c9-8642b6bce096","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:b0c92028811520edcfe380cb426327d403d0cc37174991ac777f90a813bb1cde","observation_id":"983f0295-553d-49d1-82fe-f06fe1da0b4b","resolution":{"observed_at":"2026-05-24T02:58:48.435021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llm is like a box of chocolates: the non-determinism of chatgpt in code generation","venue":null,"work_id":"d4824f32-ec28-4cf2-b586-e4e4995c4236","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:cba1f4bedc0898862433b9a0b2e40179fbb6f095fb8318adee412d624c0af7b4","observation_id":"0727736f-1971-451c-9f0b-07af7e1f2670","resolution":{"observed_at":"2026-05-24T02:58:48.465218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A comparative study of code generation using chatgpt 3.5 across 10 programming languages","venue":null,"work_id":"e9a2b6d3-310b-4e55-b9f2-3626a533dcee","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:1798bfb108bf6a2115a84bb21e2ac00428639ec9375f32efa9a048679115f805","observation_id":"bd4ab707-2c90-4b58-b023-5b7e5c6aa594","resolution":{"observed_at":"2026-05-24T02:58:48.473339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A systematic evaluation of large language models of code","venue":null,"work_id":"ff0d8c37-e1f4-4771-9049-001f6f2dd935","year":2022},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:cc292d6e6db83d550d0291e7cd548fcff296891195799176e5ed5ceb97e8ea4f","observation_id":"b3719464-84b2-4e64-a4ce-3b84d0beb58b","resolution":{"observed_at":"2026-05-24T02:58:48.470363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Discovering the syntax and strategies of natural language programming with generative language models","venue":null,"work_id":"b029e901-34e6-4731-b4c5-b09a477dca8c","year":2022},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:a0bd59e9878443b59adba2e61569822b06ac40fe61b40d7661d01fea40247e8e","observation_id":"5d1b62fa-3040-4a67-882b-b3de135326bc","resolution":{"observed_at":"2026-05-24T02:58:48.462373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06815","last_updated":"2024-01-11T22:47:35Z","snapshot_observed_at":"2026-07-06T15:15:30.340543Z","submitted_at":"2023-04-13T20:49:35Z","title":"Automatic Semantic Augmentation of Language Model Prompts (for Code Summarization)","version":3},"cited_work":{"arxiv_id":"2304.06815","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.06815","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving few- shot prompts with relevant static analysis products","venue":null,"work_id":"00d891f0-fedd-48ce-9159-dc3df468cba3","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2304.06815","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:a00b6696d1e2ac2259ef9c1b8e0b9581b708d51228738f0326d7421ca80e4e8d","observation_id":"8c112c3b-eabc-4df9-8d64-5e0e89b286c3","resolution":{"observed_at":"2026-05-24T02:23:46.185956Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating the code quality of ai-assisted code generation tools: An empirical study on github copilot, amazon codewhisperer, and chatgpt","venue":null,"work_id":"107b0b7b-131c-4c32-af30-8ac0df718190","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:28cbe8060baeda68a49f16a3e268d3d37772e6f2575b62f3e7414678c67fe44d","observation_id":"52e5b055-642d-457c-bcf6-c1df0bde7756","resolution":{"observed_at":"2026-05-24T02:58:48.459113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Is your code generated by chatgpt really correct? rigorous evaluation of large language models for code generation","venue":null,"work_id":"037f6f4e-da8b-47ee-b5c4-73ddfb00e766","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:b0d5f64fcdb0a56492980e59422552103c23f1e33bd6f7f7f6626892adcac14f","observation_id":"45d9e0e4-4130-4d53-ac9b-69d403d0189a","resolution":{"observed_at":"2026-05-24T02:58:48.530453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17780","last_updated":"2023-09-07T11:29:44Z","snapshot_observed_at":"2026-08-12T12:03:37.857970Z","submitted_at":"2023-03-31T02:57:15Z","title":"AceCoder: Utilizing Existing Code to Enhance Code Generation","version":3},"cited_work":{"arxiv_id":"2303.17780","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.17780","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards enhancing in-context learning for code generation","venue":null,"work_id":"42aa41a9-22bf-4752-acc6-10a1db20e291","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2303.17780","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:8d297bd14b97b85c4da5f1a3f93f07928f517e9e46a5a141b1d9aded2fa3a63e","observation_id":"e43c588f-52be-4ee6-93e1-e84185ca45bb","resolution":{"observed_at":"2026-05-24T02:23:46.151950Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14699","last_updated":"2025-06-23T11:31:33Z","snapshot_observed_at":"2026-07-06T14:10:40.245457Z","submitted_at":"2022-10-26T13:28:14Z","title":"Piloting Copilot, Codex, and StarCoder2: Hot Temperature, Cold Prompts, or Black Magic?","version":3},"cited_work":{"arxiv_id":"2210.14699","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14699","snapshot_observed_at":"2026-07-04T18:40:03.100223Z","title":"Piloting copilot and codex: Hot temperature, cold prompts, or black magic?","venue":null,"work_id":"648163c1-2a59-424e-9be8-3b6a9d2a1752","year":2022},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2210.14699","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:72427681693781b4c90c2e8953fa2332c8f06d2b6707b1b49bebd1f654e8a1d0","observation_id":"bb54cf4e-ee19-48a6-9c4f-d4f154fa64c3","resolution":{"observed_at":"2026-05-24T02:23:46.157957Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Controlling large language models to generate secure and vulnerable code","venue":null,"work_id":"de4d5884-c7fc-461b-aae6-48866c677ec0","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:d7786154c2b564ba2037dcefbc3fdf454c8e9cec4562bf206843fbf3f800d333","observation_id":"f55fcf35-99be-4496-b89c-14bbcf9deae0","resolution":{"observed_at":"2026-05-24T02:58:48.527463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.07839","last_updated":"2023-03-11T14:43:17Z","snapshot_observed_at":"2026-07-06T15:03:08.992538Z","submitted_at":"2023-03-11T14:43:17Z","title":"ChatGPT Prompt Patterns for Improving Code Quality, Refactoring, Requirements Elicitation, and Software Design","version":1},"cited_work":{"arxiv_id":"2303.07839","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.07839","snapshot_observed_at":"2026-07-04T01:49:21.465998Z","title":"Chatgpt prompt patterns for improving code quality, refactoring, requirements elicitation, and software design","venue":null,"work_id":"8529c1c7-4145-450d-87d0-a1baf55f8e10","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2303.07839","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:e5acbe56cd5b4a78335f0d1791ae8eb571fbaace3c2d879bfe0f9d52372919d1","observation_id":"3912cf41-b336-49eb-8bb4-d812bbc2fff1","resolution":{"observed_at":"2026-05-24T02:23:46.192371Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Skcoder: A sketch- based approach for automatic code generation","venue":null,"work_id":"91f3482a-fd43-4b3a-ac9f-4d761ab961e4","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:43dd38b24c0fb1a3eae1e13a48c1fe1194be69ed7c01a57d093c56441c89ed1c","observation_id":"2255bea7-8e34-44b7-9189-b0d37f27e127","resolution":{"observed_at":"2026-05-24T02:58:48.524517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06599","last_updated":"2023-09-07T11:39:07Z","snapshot_observed_at":"2026-08-12T14:31:00.435484Z","submitted_at":"2023-05-11T06:43:37Z","title":"Structured Chain-of-Thought Prompting for Code Generation","version":3},"cited_work":{"arxiv_id":"2305.06599","doi":"10.48550/arxiv.2305.06599","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.06599","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Enabling programming thinking in large language models toward code generation","venue":"arXiv (Cornell University)","work_id":"a96b7963-b8de-4aa1-b8f7-2120b97c525c","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2305.06599","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:211d0f0373405594a634d639b9df2fcd24d2211ba63743c172b53007468770fc","observation_id":"12afd70d-5f50-4f06-bf81-1f6f0b6d11dc","resolution":{"observed_at":"2026-05-24T02:23:46.110081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02907","last_updated":"2023-06-05T14:12:46Z","snapshot_observed_at":"2026-08-09T01:00:18.499619Z","submitted_at":"2023-06-05T14:12:46Z","title":"SelfEvolve: A Code Evolution Framework via Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.02907","doi":"10.48550/arxiv.2306.02907","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.02907","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Selfevolve: A code evolution framework via large language models","venue":"arXiv (Cornell University)","work_id":"d849190b-3ef7-4c04-ae19-e70d7db67805","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2306.02907","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:f2fea40d12846fa0bdcdc9a9214ee3765c8f9624fb19b1d985bc65cbbf49aa33","observation_id":"74942462-14c6-459b-b23b-5be498f7b7ca","resolution":{"observed_at":"2026-05-24T02:23:46.116830Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:38e8975fad24cdf66230244628fa1267d9e3a2dcc7738b0a30c65e9e76df0565","observation_id":"1b91a291-db47-43df-847d-67a29c3ef1f7","resolution":{"observed_at":"2026-05-24T02:23:46.145956Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10778","last_updated":"2023-10-22T01:48:39Z","snapshot_observed_at":"2026-08-12T14:10:31.882039Z","submitted_at":"2023-04-21T07:08:26Z","title":"Evaluating the Code Quality of AI-Assisted Code Generation Tools: An Empirical Study on GitHub Copilot, Amazon CodeWhisperer, and ChatGPT","version":2},"cited_work":{"arxiv_id":"2304.10778","doi":"10.48550/arxiv.2304.10778","metadata_source":"arxiv_reference","pith_arxiv_id":"2304.10778","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating the code quality of ai-assisted code generation tools: An empirical study on github copilot, amazon codewhisperer, and chatgpt","venue":"arXiv (Cornell University)","work_id":"fc34d942-a4d6-4670-b39a-c6c5537410cb","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2304.10778","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:ab348fd6e67d2cab01e553715b930ef722abcfa9167193516c1bd6d8de171a59","observation_id":"a3f13fc8-8b45-49ed-bace-4b3494f1e763","resolution":{"observed_at":"2026-05-24T02:23:46.135108Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03494","last_updated":"2023-04-03T20:02:26Z","snapshot_observed_at":"2026-07-06T14:49:15.927337Z","submitted_at":"2023-02-06T04:21:59Z","title":"A Categorical Archive of ChatGPT Failures","version":8},"cited_work":{"arxiv_id":"2302.03494","doi":"10.48550/arxiv.2302.03494","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03494","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A categorical archive of chatgpt failures","venue":"arXiv (Cornell University)","work_id":"b8a1b3d4-af5a-4df5-bd67-bf97bc517b2b","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2302.03494","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:2c9fb872296a8f0f2d47678086acae0a756fbe75fbac934898d8a0903077abdc","observation_id":"a21a166f-d735-455f-9731-7ff1e62fcb51","resolution":{"observed_at":"2026-05-24T02:23:46.122783Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language models of code fail at completing code with potential bugs","venue":null,"work_id":"38244827-1f0c-45fb-97b1-e8d558d2eedc","year":2024},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:6d3e444804e635b43fd936e0e701f05cd243b8223a3a8df445f9292544243750","observation_id":"3039b614-7ec3-4144-b47d-44f5d976c998","resolution":{"observed_at":"2026-05-24T02:58:48.521756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13319","last_updated":"2023-08-25T11:49:27Z","snapshot_observed_at":"2026-07-06T16:10:23.328130Z","submitted_at":"2023-08-25T11:49:27Z","title":"COCO: Testing Code Generation Systems via Concretized Instructions","version":1},"cited_work":{"arxiv_id":"2308.13319","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.13319","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Coco: Testing code generation systems via concretized instructions","venue":null,"work_id":"294433e4-fa78-4837-b8c8-03a224636bdb","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2308.13319","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:a66a42fae8d357cd27f5c21fafea2caa4815f58af22d4236b9539f64fa2b2775","observation_id":"4a01d87c-462a-49fe-aca8-02cc9280f75a","resolution":{"observed_at":"2026-05-24T02:23:46.174652Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the robustness of code generation techniques: An empirical study on github copilot","venue":null,"work_id":"97bc6542-49cc-4946-96ba-88853a0ac5c1","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:9ab933b7c618ece5786abe9345886dee095fe8f662ba1f020f2b488a7102674d","observation_id":"8c69fa5f-b43a-4fbe-a45d-45c35e69c58a","resolution":{"observed_at":"2026-05-24T02:58:48.514738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The marabou framework for verification and analysis of deep neural networks","venue":null,"work_id":"682db0b1-affb-4022-b197-0e6dd9b98999","year":2019},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:b29d8248fe129df2e035669f5d0d95c1586ccc77d61ee92001267b9544afaff1","observation_id":"c203eaf6-6d34-4d5b-97a3-f600a48c0e8e","resolution":{"observed_at":"2026-05-24T02:58:48.517483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reluplex: An efficient smt solver for verifying deep neural networks","venue":null,"work_id":"fd3f7aaf-f58a-4cca-8053-ed644c35bb8d","year":2017},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:8e7701c9817a1025bc33081bc891b4be1d6ee374d0ce115c5a0299a3e8747d21","observation_id":"8edf17cf-614b-4b4b-9c23-80dce08215c5","resolution":{"observed_at":"2026-05-24T02:58:48.512072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Piecewise linear neural networks verification: A comparative study","venue":null,"work_id":"33532a46-9fd6-4ffc-bd30-edba93b1f901","year":2018},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:db33269dd932f6ef38dd31a44db15c1cde8d9663d65f669e5b29bf8e9f306b17","observation_id":"277d1a3e-7fc7-4f95-99c0-561767db9d53","resolution":{"observed_at":"2026-05-24T02:58:48.509288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Branch and bound for piecewise linear neural network verification","venue":null,"work_id":"dcab4516-6331-47af-982b-4e5be86e5fc6","year":2020},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:2ec737e65104b09027fbd38889e6bbfbcf85d2f3ac5e975855d472ecda573890","observation_id":"b932267a-048a-4377-9bcb-dd2326650995","resolution":{"observed_at":"2026-05-24T02:58:48.506750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Concolic testing for deep neural networks","venue":null,"work_id":"03ee0b96-9a7f-4046-815c-5836ff2cf630","year":2018},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:49daae4d0747b21c8a87e96574cc459fa6d60388e249cc2ea139b99daf79a742","observation_id":"d66cd76a-a64a-431b-a8fa-61fde29c17bd","resolution":{"observed_at":"2026-05-24T02:58:48.503835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robustness verification of classification deep neural networks via linear programming","venue":null,"work_id":"74a65ca4-8588-45af-a1b3-d00645c50422","year":2019},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:ff62897b3ddfc30f13f485ab8922a7fdd43e49bcd051defe5179a1e631985fc4","observation_id":"9f7a29e5-801e-4c37-b760-cf875bdce038","resolution":{"observed_at":"2026-05-24T02:58:48.501134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast and effective robustness certification","venue":null,"work_id":"846a9dc5-6858-4e1f-b109-1d775d66dae7","year":2018},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:e4b60f870629b615836782669632177a54c1dee7c95c2f95fbfa3db6be93a6c6","observation_id":"d023bc46-0275-4191-a0b2-be6cd23850d1","resolution":{"observed_at":"2026-05-24T02:58:48.498373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An abstract domain for certifying neural networks","venue":null,"work_id":"3a450fb7-1075-447e-b78e-92266a42bb2d","year":2019},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:39bb3adb9eba7f5ac31dae2ab56b43bb67829fec9525b4b1356c58fb511aceab","observation_id":"546fa416-c1f2-4361-91c4-320fc8bcf55c","resolution":{"observed_at":"2026-05-24T02:58:48.489056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Formal security analysis of neural networks using symbolic intervals","venue":null,"work_id":"cf17a520-9531-4437-b846-3adc395a175d","year":2018},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:d6aec6b6c211fa8ba6f5e00e74748077b52c20946708fbc31979767fe7276e65","observation_id":"dcb50ce1-e799-4f41-b6a4-3fc31067eea8","resolution":{"observed_at":"2026-05-24T02:58:48.495416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable quantitative verification for deep neural networks","venue":null,"work_id":"b1e2c7e0-5f61-4eb9-988e-b06e0991edcd","year":2021},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:69ff61103f38c855ddd15d6412f1d414068e669a8f6703bf7cca08c5ef437090","observation_id":"cd9b02ad-4f81-4e27-89c2-5aef27134e45","resolution":{"observed_at":"2026-05-24T02:58:48.485363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deephunter: a coverage-guided fuzz testing framework for deep neural networks","venue":null,"work_id":"cfe6c777-fd46-4271-8569-dab5850f7d8a","year":2019},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:9c4bac5fed00c554c0bb73446363c75c798f8a53670dda7969d036d0cb5d6ab5","observation_id":"db813d53-cfd0-4c90-b593-eba167c9309f","resolution":{"observed_at":"2026-05-24T02:58:48.482711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.12543","last_updated":"2020-02-28T04:47:31Z","snapshot_observed_at":"2026-08-08T11:04:26.074062Z","submitted_at":"2020-02-28T04:47:31Z","title":"Metamorphic Testing: A New Approach for Generating Next Test Cases","version":1},"cited_work":{"arxiv_id":"2002.12543","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2002.12543","snapshot_observed_at":"2026-07-04T12:39:49.230696Z","title":"Metamorphic testing: a new approach for generating next test cases","venue":null,"work_id":"86215440-bb96-48e8-ad27-6b8279b56e9f","year":2002},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"cited_paper":"/paper/2002.12543","citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:5c24b8329f1e0d2afa4cd7a62e99a70a52b2a0adb68c25a9f52d10827610fe3a","observation_id":"bf1c9bad-605c-4d1c-8a6e-1003214e2ca4","resolution":{"observed_at":"2026-05-24T02:23:46.180357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language models: The next frontier for variable discovery within metamorphic testing?","venue":null,"work_id":"8d8e6801-3fc8-4f0e-a0c7-f09abf0b98e4","year":2023},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:9c4523d6f2eb4babaad8899c0826fe9a64aaa82599ba2a1c2754e1fdc1f5287f","observation_id":"466737bb-74cb-49bd-b969-5bbc611b1b7b","resolution":{"observed_at":"2026-05-24T02:58:48.479165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Assessing robustness of ml-based program analysis tools using metamorphic program transforma- tions","venue":null,"work_id":"4f54ced4-3560-45ef-a01b-9d040154ccfb","year":2021},"citing_paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-24T02:19:23.135463Z"},"links":{"citing_paper":"/paper/2404.01535"},"observation_digest":"sha256:c18fccd258e3db7aad08e7d28ab3a067ad3bc111ea1e5fdf386bbd0768a74088","observation_id":"d0d53004-e57e-4a4a-a5f0-5573f7166fac","resolution":{"observed_at":"2026-05-24T02:58:48.476132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2404.01535","last_updated":"2026-05-07T23:29:27Z","latest_version":2,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-02T07:17:07.567055Z","submitted_at":"2024-04-01T23:55:05Z","title":"Assessing, Exploiting, and Mitigating Syntactic Robustness Failures in LLM-Based Code Generation"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":15,"verified_fuzzy":30},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2404.01535."}