{"as_of":"2026-08-08T01:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53bf57f53ed57f58a4ddd4173fc8e0d518239574e3cb41eae5f42909d76f8675","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:42:05.472880Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T15:06:55.050376Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T05:57:24.432794Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"cited_work":{"arxiv_id":"2506.13186","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13186","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8eac06ed-cc04-4b04-911d-deff4fb150bb","year":2025},"citing_paper":{"arxiv_id":"2602.08561","last_updated":"2026-04-23T07:57:30Z","snapshot_observed_at":"2026-07-06T22:45:05.823859Z","submitted_at":"2026-02-09T11:59:59Z","title":"Automating Computational Reproducibility in Social Science: Comparing Prompt-Based and Agent-Based Approaches","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T05:55:48.203213Z"},"links":{"cited_paper":"/paper/2506.13186","citing_paper":"/paper/2602.08561"},"observation_digest":"sha256:9b2723c6db92f8d20a8dc22d5eef3ffef7f1f4bd3c8811d5d443c7a031ec399d","observation_id":"6827e5a6-d000-403b-bcf7-ea2837457152","resolution":{"observed_at":"2026-05-16T05:57:24.435042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13186","snapshot_observed_at":"2026-08-01T15:06:55.050376Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18550","last_updated":"2026-07-20T22:32:23Z","snapshot_observed_at":"2026-08-07T23:26:41.473754Z","submitted_at":"2026-07-20T22:32:23Z","title":"Semantic Drift in Bug Resolution: How Behavioral Signals Propagate from Reports to Tests and Patches","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:55.050376Z"},"links":{"cited_paper":"/paper/2506.13186","citing_paper":"/paper/2607.18550"},"observation_digest":"sha256:8574b58f1d2e1f2ae7a133805950331be13d608f9ddc3e5f97b11f0b40539ff8","observation_id":"431b66bc-afd3-450e-bfd8-2ebc102b0793","resolution":{"observed_at":"2026-08-01T15:06:55.050376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.13186/citation-record","integrity":"/paper/2506.13186/integrity","json":"/paper/2506.13186/citation-record.json","paper":"/paper/2506.13186"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.237055Z","title":"The debugging mindset: Understanding the psychology of learning strategies leads to effective problem-solving skills","venue":null,"work_id":"2f661837-77ec-4381-8177-8b46d4b15681","year":2017},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:59.444522Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:8dfe54b6be1af9399d811794f0d981897512d4d93c637c862fc37903c0738b1d","observation_id":"b167f023-3aeb-4ead-87bb-3be516ef7ee1","resolution":{"observed_at":"2026-08-07T00:42:06.240703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.227586Z","title":"Genprog: A generic method for automatic software repair,","venue":null,"work_id":"d7176e35-52a8-4200-ba22-b265084d19c8","year":2011},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:59.501952Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:afa9dd20c15731e83487dd781fdb3ac6312b1963bd30501625b4dceeb09cd508","observation_id":"b0258e0a-e192-4a1c-8c68-00beae8a946a","resolution":{"observed_at":"2026-08-07T00:42:06.230666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.218038Z","title":"Nopol: Automatic repair of conditional statement bugs in java programs,","venue":null,"work_id":"16fd08a5-ba72-4890-b1eb-e5384f34963e","year":2016},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:59.555989Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:10cad77cf9d9660f36b6bc589921a202ef887ec2781c0ee8237e8a3bf500df4e","observation_id":"fec9e93c-374f-43be-ab4d-ccb6c5fdc2b6","resolution":{"observed_at":"2026-08-07T00:42:06.221383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.208571Z","title":"S3: syntax- and semantic-guided repair synthesis via programming by examples,","venue":null,"work_id":"c9c19678-da66-48ca-9a7d-a4f9b0d77cfb","year":2017},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:59.663118Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:3c90f9f7d24a5c7488f6b65409a40ae84af038a0ebcebe6aa89b940172a009da","observation_id":"1be5c364-e6c2-4dd1-9dff-5d0d56b98bf4","resolution":{"observed_at":"2026-08-07T00:42:06.211545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.198831Z","title":"Staged program repair with condition synthesis,","venue":null,"work_id":"b68a38d7-84f6-4afc-8dd6-6323fdfb89c5","year":2015},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:59.728744Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:04fb08ba757c63fce7a9b297ac9f1f8fd6e2a01c2d1943fd09e5bddeb7650e31","observation_id":"f3684160-823d-471d-aabd-bf85a36a4d0c","resolution":{"observed_at":"2026-08-07T00:42:06.202384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.189339Z","title":"Angelix: Scalable multiline program patch synthesis via symbolic analysis,","venue":null,"work_id":"7e177dc6-9e14-47ab-ac95-b9b46c1070ac","year":2016},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:59.800504Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:8b0043c0d9382d2680de514964b22373df2be51d801952175c72a3dae7fbfa91","observation_id":"e5142586-429b-4d87-8f3b-e8613068e4c7","resolution":{"observed_at":"2026-08-07T00:42:06.192887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.180130Z","title":"Astor: A program repair library for java,","venue":null,"work_id":"1659707b-0919-4d10-949e-9caaae98fd4e","year":2016},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:59.850334Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:85a9a32e100cc321982eb4beeeca9614f1ba9e14ab20094619847ab7c82d6f8f","observation_id":"12bfc4d2-6a0e-4392-9338-213d63a946a7","resolution":{"observed_at":"2026-08-07T00:42:06.183114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.170278Z","title":"History driven program repair,","venue":null,"work_id":"33419c63-8e24-466d-974b-6e5a1469ccd0","year":2016},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:59.908963Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:01fc1429d45271758df652184d732de7660dcb8c5388d520abb7a43784735fd3","observation_id":"dcbd5c05-4553-4527-a135-7da6f642e4f1","resolution":{"observed_at":"2026-08-07T00:42:06.173408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.159438Z","title":"Automatic patch generation by learning correct code,","venue":null,"work_id":"2d2a76ed-ef72-4aa3-8d19-d689b26b5733","year":2016},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:59.998933Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:dce29f2265b8d7a158785e53af244725dcd065fda7e02a8a37f55acefe62e1c1","observation_id":"d4f33bc5-e716-4ef2-a8db-f104b7270513","resolution":{"observed_at":"2026-08-07T00:42:06.163121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.149562Z","title":"Leveraging syntax-related code for automated program repair,","venue":null,"work_id":"188c5a17-6fcd-40b4-ba65-9befa345950a","year":2017},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.044997Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:7c87f7f6ca6dcb31d18854144681b73a0ce34a460aa72f15f438b344a65c12fe","observation_id":"a82ae89a-5d64-4f65-8722-3a611339bd54","resolution":{"observed_at":"2026-08-07T00:42:06.152650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.140059Z","title":"Precise condition synthesis for program repair,","venue":null,"work_id":"dcd21d2b-e92b-47cc-89f9-12bf0a5e7e83","year":2017},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.134660Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:2a1e9f0bae8b0ede04acfc345d9be94cadef39bd7184cd181664819fadfecb1e","observation_id":"1a9e125e-47fc-43ad-9b21-e394ad4819b3","resolution":{"observed_at":"2026-08-07T00:42:06.143327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.129796Z","title":"Automatic inference of code transforms for patch generation,","venue":null,"work_id":"47127a48-a2ce-4ee3-aefa-d94549208af0","year":2017},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.179038Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:e31e8bd3c99b129be9091f6d437ebb97228e0aa596a02ea72d7f6d3ff47bfe69","observation_id":"8daf1de8-8a74-4f81-8fd6-cd5eb1935dc9","resolution":{"observed_at":"2026-08-07T00:42:06.133299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.120685Z","title":"Towards practical program repair with on-demand candidate generation,","venue":null,"work_id":"738d11c3-418c-4667-8671-50eb2e3d41c7","year":2018},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.235932Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:c681bbfe3e5dc387df257dd99df8000835f709f577e04fd2e5255a88b2e1315b","observation_id":"a91899b0-3bc4-4ce6-bf47-fa49b316d55d","resolution":{"observed_at":"2026-08-07T00:42:06.124032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.111708Z","title":"Context-aware patch generation for better automated program repair,","venue":null,"work_id":"b1ece938-2e7a-411e-bded-6410e6d18203","year":2018},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.296258Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:ea74ac8a148de2456d90f3b6f6fd404cb5ed68075cb5ce8b178cef9624050d0d","observation_id":"2419a248-dd07-4c16-9866-400c3d19ee80","resolution":{"observed_at":"2026-08-07T00:42:06.114649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.101885Z","title":"Shaping program repair space with existing patches and similar code,","venue":null,"work_id":"234817c7-5cf1-4b3c-bd28-ab8e0b517bc8","year":2018},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.355358Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:c1ce7c50b61d540644ec8f3f4b7de31b2ca45c1b6159e60b582cd8eac4d38bf0","observation_id":"14cee7f8-6e84-4240-8655-7ae6d43ef020","resolution":{"observed_at":"2026-08-07T00:42:06.105045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.091999Z","title":"Tbar: Revisiting template-based automated program repair,","venue":null,"work_id":"a1c6b960-5094-4456-b03e-67fce2e7901d","year":2019},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.412296Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:fb25c415a76e142844b93efb81a0f9678f159e13d4ad5562024adc941153796b","observation_id":"eab405de-641b-47f9-8578-f29250fee8fc","resolution":{"observed_at":"2026-08-07T00:42:06.095272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.081799Z","title":"Avatar: Fixing semantic bugs with fix patterns of static analysis violations,","venue":null,"work_id":"098cc057-9f40-4f08-8126-60555009d1d4","year":2019},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.508136Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:65e7beaa52c679fcc84b36b38e5c8ca4ab0c2e6c4410a519877ef55d392c00f3","observation_id":"df8f5b3c-5fdc-460c-a4b8-91ddb4702f95","resolution":{"observed_at":"2026-08-07T00:42:06.085697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.071726Z","title":"Practical program repair via bytecode mutation,","venue":null,"work_id":"26fdc14c-915b-4eb5-924c-c3c6ddb92d75","year":2019},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.563390Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:2bfa54d317c72274695c2c0b09b2f37cbb0162f4f0782356896bca317c12b026","observation_id":"824fb81a-f85f-4cdd-be5d-7612145a97ea","resolution":{"observed_at":"2026-08-07T00:42:06.075497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.061569Z","title":"Inferring program transfor- mations from singular examples via big code,","venue":null,"work_id":"70f7c527-1c13-4fc9-bbd9-4dd5e45dc4b6","year":2019},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.614514Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:a6c0ea2dbee0fbc420b979784ff6aab84c5eec78654deb22a7287da2bfa6a45f","observation_id":"40a98f43-ce8c-4078-a88a-9c3e76c300d4","resolution":{"observed_at":"2026-08-07T00:42:06.064987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.051299Z","title":"The plastic surgery hypothesis in the era of large language models,","venue":null,"work_id":"40e656c1-7c97-4790-8905-f661bc61570d","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.669053Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:09b9a5b9d9fb662e1a3e9a320ca45f4144b007a46dea0795dfbebcf02622e6d0","observation_id":"6e5ff99e-aa98-4872-9f3d-93c009ec6061","resolution":{"observed_at":"2026-08-07T00:42:06.055015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.040917Z","title":"Sequencer: Sequence-to-sequence learning for end- to-end program repair,","venue":null,"work_id":"b75c45eb-5f9c-4813-8c7d-0cbb3f478b27","year":1943},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.722403Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:cb8baa6d9e2b12fc188110b529facb515d24f3743afa671364577a8b3d5f7ab6","observation_id":"76c5b301-c4e8-4f53-b2ca-f42df3cd92d7","resolution":{"observed_at":"2026-08-07T00:42:06.044297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.031759Z","title":"Coconut: combining context-aware neural translation models using ensemble for program repair,","venue":null,"work_id":"368d2552-cca9-4e22-8eb3-aff917f5092f","year":2020},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.775241Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:deeb10b72f9c4e5c3b97ef18715d2b24cb130e0cb96692778108f977a1cf62e4","observation_id":"20d6c679-fdae-4ccb-854e-c531c40ebe60","resolution":{"observed_at":"2026-08-07T00:42:06.035055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.022625Z","title":"Dlfix: Context-based code transformation learning for automated program repair,","venue":null,"work_id":"8acc6955-218a-4112-a88d-8322299507ed","year":2020},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.856107Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:6c4db7b924f9c3a438386153439671b39c072c1fd2558503a52e9279c303fe00","observation_id":"83986091-dad1-4b05-8a6e-9e7f4ee67b54","resolution":{"observed_at":"2026-08-07T00:42:06.025782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.012976Z","title":"A syntax-guided edit decoder for neural program repair,","venue":null,"work_id":"1811db1e-f584-44bd-9190-9d501161f50f","year":2021},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.924694Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:b4c232e41ad28e6df8f6964d47ed31e62705b9fc91273e4be6f1c01c46a4de10","observation_id":"e6de4167-2e91-408d-a26e-4926315cfdb1","resolution":{"observed_at":"2026-08-07T00:42:06.016369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:06.002222Z","title":"Cure: Code-aware neural machine translation for automatic program repair,","venue":null,"work_id":"817eddde-b062-455c-9daf-94b371bb2193","year":2021},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:00.976528Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:283e8cad8496512aa3ebccb35c513dc9c7ab33fc47fd9efccd030652e112efe1","observation_id":"8796f69d-9ee4-44d4-bb53-ffaca7f768e3","resolution":{"observed_at":"2026-08-07T00:42:06.005991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.991757Z","title":"Neural program repair with execution-based backpropagation,","venue":null,"work_id":"1177156f-e0a0-41ac-bbe3-de1fde791120","year":2022},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:01.051254Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:17bebd04b9d4b094da67380c1515531b4f5486294df3c04700147df149011f30","observation_id":"be5ffd9d-7362-4a38-95c6-0f8edb534c66","resolution":{"observed_at":"2026-08-07T00:42:05.995572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.981582Z","title":"Tare: Type-aware neural program repair,","venue":null,"work_id":"262ed9a4-8c30-40a9-9383-7808eb5fbc04","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:01.187004Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:43872c99c05d6b60833dcd1ce7cb50b16d9c2088fccfb0d307177e98fe99993c","observation_id":"eb43304e-50c7-41e2-a187-5ca3ef30ac27","resolution":{"observed_at":"2026-08-07T00:42:05.984769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.971535Z","title":"Vulrepair: a t5-based automated software vulnerability repair,","venue":null,"work_id":"4a1a2621-8dbc-4b97-a701-7f14494ebc8c","year":2022},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:01.293848Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:8770e59ebf3f1bd084dc93f88f32d9f51fe85e11289110051f80bac3f0a46ae4","observation_id":"39adb762-c39f-4fb0-8f79-b49f7e1bc8df","resolution":{"observed_at":"2026-08-07T00:42:05.975049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.961507Z","title":"Less training, more repairing please: revisiting automated program repair via zero-shot learning,","venue":null,"work_id":"5c4b8cbf-4542-441c-8e52-34f11e945ef8","year":2022},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:01.341834Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:57d042fe44fbfc44de49ca3052bf41f1f18339911aee10d1ed86890414ed6e58","observation_id":"45ed4b8a-9196-4c11-93e4-7d97271e9cf8","resolution":{"observed_at":"2026-08-07T00:42:05.964939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:01.431179Z","title":"Prompting is all you need: Automated android bug replay with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:01.431179Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:815de08eb5710faa44a2a4000395c6b22d65e786858d98e3c43f53f8ff1af07a","observation_id":"bd9d3dd8-2e81-4187-a3f6-eadb708e6b81","resolution":{"observed_at":"2026-08-07T00:42:01.431179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03850","last_updated":"2022-03-08T04:48:07Z","snapshot_observed_at":"2026-08-02T05:58:04.510079Z","submitted_at":"2022-03-08T04:48:07Z","title":"UniXcoder: Unified Cross-Modal Pre-training for Code Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03850","snapshot_observed_at":"2026-08-07T00:42:01.663531Z","title":"Unixcoder: Unified cross-modal pre-training for code representation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:01.663531Z"},"links":{"cited_paper":"/paper/2203.03850","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:acfd2ca4d23e693e4ea8603332f2a198dcaca04acd6f45995c22485936da855a","observation_id":"f30c9134-5bde-46a6-83ae-1f22e9b1e495","resolution":{"observed_at":"2026-08-07T00:42:01.663531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13474","last_updated":"2023-02-27T21:26:48Z","snapshot_observed_at":"2026-07-06T12:52:16.992962Z","submitted_at":"2022-03-25T06:55:15Z","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13474","snapshot_observed_at":"2026-08-07T00:42:01.795662Z","title":"Codegen: An open large language model for code with multi-turn program synthesis,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:01.795662Z"},"links":{"cited_paper":"/paper/2203.13474","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:ec3e6a9616a280b19eedbd4b613e901af24691733beff7b3b3318554e53148f3","observation_id":"87540288-3fae-4b86-ad57-5ffbc7223095","resolution":{"observed_at":"2026-08-07T00:42:01.795662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07922","last_updated":"2023-05-20T07:27:15Z","snapshot_observed_at":"2026-08-01T08:49:52.462843Z","submitted_at":"2023-05-13T14:23:07Z","title":"CodeT5+: Open Code Large Language Models for Code Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07922","snapshot_observed_at":"2026-08-07T00:42:01.938924Z","title":"Codet5+: Open code large language models for code understanding and generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:01.938924Z"},"links":{"cited_paper":"/paper/2305.07922","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:cb9b26fe592b3baf7179744d67f6a5d6918e10d7f402f4e821273884ff4c5b0a","observation_id":"72d2a4e6-3669-4d0b-8395-a636b64f53b1","resolution":{"observed_at":"2026-08-07T00:42:01.938924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.944867Z","title":"Few-shot training llms for project-specific code-summarization,","venue":null,"work_id":"072fb3de-f45d-4483-9850-8af89de8ce36","year":2022},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:02.070297Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:4665bf3590ac9cd44e8b2a5d2a176ab73b081170205556afaec67fe2d01eec25","observation_id":"a14e427d-ca39-4cc4-aa8d-5d032d4c6a55","resolution":{"observed_at":"2026-08-07T00:42:05.948557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.935822Z","title":"Can openai’s codex fix bugs? an evaluation on quixbugs,","venue":null,"work_id":"4fd3caba-11cd-4a7d-ab92-06109416190b","year":2022},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:02.236582Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:c0024bcc495ae2c45faac4b738359f2d8db4a1af6bcd6063ef19d89042504048","observation_id":"11988c79-de0a-4047-b547-158d6c01a4cf","resolution":{"observed_at":"2026-08-07T00:42:05.938979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.926276Z","title":"Impact of code language models on automated program repair,","venue":null,"work_id":"3fe55755-8258-40f5-b2ea-6b612fc4bcdc","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:02.352819Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:496602b219b431710207c64ef2999dd9d94b9d605820485fe23a9aaddaf452a9","observation_id":"71212d70-bae2-4a25-a985-2dae3756a3e8","resolution":{"observed_at":"2026-08-07T00:42:05.929747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.916559Z","title":"Automated program repair in the era of large pre-trained language models,","venue":null,"work_id":"0a2732a4-5fee-4e70-97eb-05065502efd9","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:02.553542Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:9f455d078331f026a892281ab6dfcf54c38bdd0b451167530cd9675e925dcdca","observation_id":"a5dc196a-4e68-4f5f-b48d-92ac96460765","resolution":{"observed_at":"2026-08-07T00:42:05.920026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.906235Z","title":"Automated repair of programs from large language models,","venue":null,"work_id":"ee3132ce-90b5-4e0c-977d-aafd962e94aa","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:02.700004Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:69eb2dfed80c1aa5c5daf22dd3d68c6f383aafba043ea5f9792d7cecc23986c3","observation_id":"b6741863-1deb-43b7-90ac-7eb0d1fbccaa","resolution":{"observed_at":"2026-08-07T00:42:05.909849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.895542Z","title":"Gamma: Revisiting template-based automated program repair via mask prediction,","venue":null,"work_id":"d4873f40-2160-47ef-9482-4c579eb8f0f5","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:02.816392Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:7e77e6a4505aab788e360a2cbaea13f93416a4541187b3e71e5145e3f7ca8387","observation_id":"96adef9e-365e-494a-b863-4b0c845df6ea","resolution":{"observed_at":"2026-08-07T00:42:05.899311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.885578Z","title":"Thinkrepair: Self-directed automated program repair,","venue":null,"work_id":"3e8299a0-b890-432a-985c-41f521efc30a","year":2024},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:02.981678Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:386b9c653971241ff6c9fea802a0cd77045d82d703cb8cbc2259264911bfad09","observation_id":"ce07b5f5-d85c-4cb4-8702-e0107a8877f3","resolution":{"observed_at":"2026-08-07T00:42:05.888905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00385","last_updated":"2024-12-09T20:45:33Z","snapshot_observed_at":"2026-08-07T04:08:23.682670Z","submitted_at":"2023-04-01T20:57:33Z","title":"Keep the Conversation Going: Fixing 162 out of 337 bugs for $0.42 each using ChatGPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.00385","snapshot_observed_at":"2026-08-07T00:42:03.138296Z","title":"Keep the conversation going: Fixing 162 out of 337 bugs for $0.42 each using chatgpt,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:03.138296Z"},"links":{"cited_paper":"/paper/2304.00385","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:196cb42c02f277cc7db82ea4392b13890429ee7b58c0beeab7eb582483db5547","observation_id":"d77097f1-f099-446a-84a6-34e63dfd4890","resolution":{"observed_at":"2026-08-07T00:42:03.138296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.875054Z","title":"An empirical study on fine-tuning large language models of code for automated program repair,","venue":null,"work_id":"bba5903b-4da1-491b-b26c-7d96972fb867","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:03.322281Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:1e7f80c510501885642148b03464530737455986b636f4c436e0db13fe5122de","observation_id":"98fd2f8f-62b1-4077-a1e6-4354f99d6d4e","resolution":{"observed_at":"2026-08-07T00:42:05.879214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12833","last_updated":"2024-10-31T08:54:53Z","snapshot_observed_at":"2026-08-03T22:53:10.552177Z","submitted_at":"2024-04-19T12:14:09Z","title":"How Far Can We Go with Practical Function-Level Program Repair?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12833","snapshot_observed_at":"2026-08-07T00:42:03.480214Z","title":"How far can we go with practical function-level program repair?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:03.480214Z"},"links":{"cited_paper":"/paper/2404.12833","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:f35e462f257d07dca7cf39dbe07629f23927cd0c10c9d17573f0d674eac08fbe","observation_id":"21468d90-0805-48e3-aec4-fca00d321f3b","resolution":{"observed_at":"2026-08-07T00:42:03.480214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08155","last_updated":"2020-09-18T15:38:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-19T13:09:07Z","title":"CodeBERT: A Pre-Trained Model for Programming and Natural Languages","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.08155","snapshot_observed_at":"2026-08-07T00:42:03.627340Z","title":"Codebert: A pre-trained model for programming and natural languages,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:03.627340Z"},"links":{"cited_paper":"/paper/2002.08155","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:c1cc2a458e5f45857c3a5f7ad62cc309c8aefd4f947f3fae7859d88368f8e98c","observation_id":"b0f7b167-a413-410c-ad5b-17c321a70e03","resolution":{"observed_at":"2026-08-07T00:42:03.627340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00859","last_updated":"2021-09-02T12:21:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-09-02T12:21:06Z","title":"CodeT5: Identifier-aware Unified Pre-trained Encoder-Decoder Models for Code Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.00859","snapshot_observed_at":"2026-08-07T00:42:03.731652Z","title":"Codet5: Identifier-aware unified pre-trained encoder-decoder models for code understanding and generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:03.731652Z"},"links":{"cited_paper":"/paper/2109.00859","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:33af4e475545284b56185ed173d436e2966710ef6887de3957ee72b781681567","observation_id":"1afb6817-ed90-44b2-8915-55e1e791a7f3","resolution":{"observed_at":"2026-08-07T00:42:03.731652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.865271Z","title":"Defects4j: A database of existing faults to enable controlled testing studies for java programs,","venue":null,"work_id":"e5e744ba-52b4-4109-b2a7-372a738006f5","year":2014},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:03.832274Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:178f1f82ba619d0ce43aa9ea4f41d47b456589cc4d58d63a7f162bb8289bd0a5","observation_id":"758c4715-52aa-4cd4-8b03-1727af3945f7","resolution":{"observed_at":"2026-08-07T00:42:05.868542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:03.902785Z","title":"The manybugs and introclass benchmarks for automated repair of c programs,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:03.902785Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:281a2004864698fcc8e02b51ce4a4b264b3e32a847cf25e754617cb1e12bdc14","observation_id":"c1fc1f57-f631-4ef0-b5f2-d8b7186e9d57","resolution":{"observed_at":"2026-08-07T00:42:03.902785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.849990Z","title":"Quixbugs: A multi- lingual program repair benchmark set based on the quixey challenge,","venue":null,"work_id":"f3092f25-1a25-48c1-816d-b6a29f3a260d","year":2017},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:04.032946Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:c1f9b4476f306d493d104ce7ff63de5812802c99a576a36dc294a48f10c52738","observation_id":"26afc1d8-52b2-4708-8300-61f244381d91","resolution":{"observed_at":"2026-08-07T00:42:05.853231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.840911Z","title":"An overview of large ai models and their applications,","venue":null,"work_id":"97fa01dd-677e-46ef-8145-a0a024637d48","year":2024},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:04.114251Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:eaa1cc6881026b878f09f55b500a2b73af6bfe15849298ad4368866a33b70e53","observation_id":"49dfc44b-32a7-4799-bdc1-6ade43900b54","resolution":{"observed_at":"2026-08-07T00:42:05.844090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-07-06T09:13:29.404788Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-07T00:42:04.244106Z","title":"The cost of training nlp models: A concise overview,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:04.244106Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:e79999a56154849beee5cec6041bc83a3d2a1aa1fc5c89881e2020d6a9c69dd5","observation_id":"f8eff1b3-e612-4aba-8e72-316a59496d27","resolution":{"observed_at":"2026-08-07T00:42:04.244106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-07T00:42:04.329887Z","title":"Code llama: Open foundation models for code,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:04.329887Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:d46fbbe4be161eb3f521ae0759eee3e583975d75004f973eef9ba7cfab131324","observation_id":"f86b1894-1265-47fa-8cb9-f80bd7d7d7b4","resolution":{"observed_at":"2026-08-07T00:42:04.329887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T00:42:04.420135Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:04.420135Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:aa9ec67bb8eccb4748e8e075ccb298cdabd15c37cb0ee9dc299f9ab287ac1ebb","observation_id":"7accd6b2-a4e5-4940-b73c-383e0f4eeffc","resolution":{"observed_at":"2026-08-07T00:42:04.420135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06161","snapshot_observed_at":"2026-08-07T00:42:04.536895Z","title":"Starcoder: may the source be with you!","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:04.536895Z"},"links":{"cited_paper":"/paper/2305.06161","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:777ca090fd9e987f12867c84ab8d2a1fcc26805f6135f5f46ddf50aa50979438","observation_id":"24a46f90-1e97-467e-88ba-1ade845c20f6","resolution":{"observed_at":"2026-08-07T00:42:04.536895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-07T00:42:04.649827Z","title":"Deepseek-coder: When the large language model meets programming – the rise of code intelligence,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:04.649827Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:08862ef7e79541e8693cb71d871b60aad9173182bdc87a140b3564dddad88b8d","observation_id":"72fb79e8-f04b-431e-a3ca-aa36c8637845","resolution":{"observed_at":"2026-08-07T00:42:04.649827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.831650Z","title":"Bugsc++: A highly usable real world defect benchmark for c/c++,","venue":null,"work_id":"3a9ff2bd-d55d-46a6-8f0b-bc186258ab62","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:04.737314Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:ba875d06c9074bf5e55e5fde8de6f40d9f03ad1cba91075cb5396f218e07eb51","observation_id":"7f35cd4c-3c94-4e94-94f1-96e2ebdd80f4","resolution":{"observed_at":"2026-08-07T00:42:05.834621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.821970Z","title":"Introclassjava: A benchmark of 297 small and buggy java programs,","venue":null,"work_id":"5cff127d-9aff-4d62-8a2c-5efa1dd758be","year":2016},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:04.810975Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:ff2423c1f0b9c8431e413a409e55349d846662deb6483484233c2ae9a6aa5e28","observation_id":"16bcf1d0-f2e3-4c55-9c95-50eea4e4a965","resolution":{"observed_at":"2026-08-07T00:42:05.825380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16253","last_updated":"2023-10-25T00:06:02Z","snapshot_observed_at":"2026-07-06T16:38:06.149536Z","submitted_at":"2023-10-25T00:06:02Z","title":"ConDefects: A New Dataset to Address the Data Leakage Concern for LLM-based Fault Localization and Program Repair","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16253","snapshot_observed_at":"2026-08-07T00:42:04.948194Z","title":"Condefects: A new dataset to address the data leakage concern for llm-based fault localization and program repair,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:04.948194Z"},"links":{"cited_paper":"/paper/2310.16253","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:51e42dae56d26c3d7620148e794c3747ce058ea13b1840cd665ca0df7402b4f8","observation_id":"85559a4d-8504-45af-a6eb-cbf78c345fe6","resolution":{"observed_at":"2026-08-07T00:42:04.948194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.051611Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.051611Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:e5cf9f6552f8bd762854191b390d3cbe80c3f57752d3ce408625024f82e1a666","observation_id":"8b11fc15-23a8-40b4-a76a-184428472385","resolution":{"observed_at":"2026-08-07T00:42:05.051611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T00:42:05.171629Z","title":"Scaling laws for neural language models,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.171629Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:56b77046e30bdc67d482b864bf4705eec080abbc4b6766878516536b4fd1c478","observation_id":"94df2463-7a28-411c-816f-51d15f78510f","resolution":{"observed_at":"2026-08-07T00:42:05.171629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.806788Z","title":"How to fine-tune bert for text classification?","venue":null,"work_id":"6ec686db-67d9-47a6-a87d-a69c4fcbafc5","year":2019},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.216894Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:6097a7e1c9f3cabe3c6f9f095e59556ecc39d303fb7cd03ff9d11f76b42f10ed","observation_id":"20d51a2a-2b9f-41d1-a7e5-9320708393e1","resolution":{"observed_at":"2026-08-07T00:42:05.809993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.797559Z","title":"Parameter-efficient fine-tuning of large-scale pre-trained language models,","venue":null,"work_id":"ce9c03f7-d0e4-4bc0-bcb2-477c157ccfd3","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.248130Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:cdf8192cad85fbd97827cf12561a771445925a6d190ee1a26b9e318bc6adb3e0","observation_id":"395ba91c-dd99-45f1-a74b-ac54d3b2a4a9","resolution":{"observed_at":"2026-08-07T00:42:05.800845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-06T15:24:34.790850Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-07T00:42:05.362416Z","title":"The power of scale for parameter- efficient prompt tuning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.362416Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:a3fb0580ef0ba6d07647cdebf0c74929179086bd69a9653a2164b462980e73a5","observation_id":"6a83e52f-062a-4de2-a231-7cfe1cd31a74","resolution":{"observed_at":"2026-08-07T00:42:05.362416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.421426Z","title":"Visual prompt tuning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.421426Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:689a7f69ddbc31872ffdb95920493c9df4bbd4cd8565d46e4b4f00d689230580","observation_id":"6fb7979d-aa5e-4487-87df-695dc7e371e8","resolution":{"observed_at":"2026-08-07T00:42:05.421426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15698","last_updated":"2025-09-03T01:34:48Z","snapshot_observed_at":"2026-07-06T17:07:52.197869Z","submitted_at":"2023-12-25T11:39:46Z","title":"RepairLLaMA: Efficient Representations and Fine-Tuned Adapters for Program Repair","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15698","snapshot_observed_at":"2026-08-07T00:42:05.424919Z","title":"Repairllama: Efficient repre- sentations and fine-tuned adapters for program repair,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.424919Z"},"links":{"cited_paper":"/paper/2312.15698","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:c8696c0eee58223194a8132d65c3d95c6f5564c21fa2eb1a07bda2c934cf1224","observation_id":"5b3dc69d-4f59-42dd-94e0-98c7e9cde194","resolution":{"observed_at":"2026-08-07T00:42:05.424919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.428384Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.428384Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:089b21558399357583cc85eaba8c2cce6a36afaec55969c0c0d56c0a2d026d07","observation_id":"0e006f2e-67e4-42de-9531-2a63aae568e5","resolution":{"observed_at":"2026-08-07T00:42:05.428384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.775061Z","title":"Language models are few-shot learners,","venue":null,"work_id":"a7221cb5-11f4-4637-a330-b3f82241d304","year":2020},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.431659Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:89c0f6d73ec67122b1f0eb790852eac3399b2f72931d8df63264686a04560c34","observation_id":"0aa587ea-34f5-40c7-ad32-a661661efd1d","resolution":{"observed_at":"2026-08-07T00:42:05.778200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.765615Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":"c6db2510-4c24-40ef-a5f8-402553701678","year":null},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.435339Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:f70686b22d1fc498e77a1278d983a5b51236236b5b61925a4e876e61492a42be","observation_id":"a15d5cee-f17f-48b3-a7f5-87d85476bd06","resolution":{"observed_at":"2026-08-07T00:42:05.768606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-07T00:42:05.441867Z","title":"Automatic chain of thought prompting in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.441867Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:e8449ea82d1ba8ff9c0f79d2ea8a724cb765b2379c50132b3a9e989ba6ee7be0","observation_id":"7e50a810-d84d-4cd0-8eb6-d0b0ab34c358","resolution":{"observed_at":"2026-08-07T00:42:05.441867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.746815Z","title":"Towards understanding chain-of-thought prompting: An empirical study of what matters,","venue":null,"work_id":"e6272a04-9784-451a-9d62-47b3663ca9c6","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.445261Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:211c50f79ff5794fff8e422ca24e90b9e7949dfafaba5f52fbf5644f9af1fb00","observation_id":"b6094612-9c13-4d54-b8cd-ceddc3b278a3","resolution":{"observed_at":"2026-08-07T00:42:05.750080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.737566Z","title":"Copiloting the copilots: Fusing large language models with completion engines for automated program repair,","venue":null,"work_id":"5a86151f-d61a-49c2-9e22-eb36f8934d4b","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.447945Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:e8881832e8734ec25fbb1b4688ce8df3eb1d005e3d2c10f38a12d0eaf04b4daf","observation_id":"ad81bf8e-c8f9-48a0-ba15-8930e9b2725f","resolution":{"observed_at":"2026-08-07T00:42:05.740858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.727716Z","title":"Language models are few-shot learners,","venue":null,"work_id":"4a15b0f0-9950-4a10-92a0-885a30150425","year":2020},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.451148Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:1b93e683511670ccecd95dcc88657b6ac57c0f8646099884c8c69b069040cd1c","observation_id":"cc987921-c713-4283-8f42-bf026044ea93","resolution":{"observed_at":"2026-08-07T00:42:05.730831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.710586Z","title":"Hybrid automated program repair by combining large language models and program analysis,","venue":null,"work_id":"12690ebd-9183-42f3-b377-698c5c570b28","year":2025},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.457284Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:fc3873806f31ec6a8fb09c70ce53fabb0238decec432d67dd7e2bec69712eb5a","observation_id":"e44f86b7-e733-4626-839b-b8b9fde34cc9","resolution":{"observed_at":"2026-08-07T00:42:05.715419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.700818Z","title":"Atcoder,","venue":null,"work_id":"9480d4cd-1779-4d15-ad9d-271a3f34227f","year":null},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.460165Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:698405950be0092a9d638918cb37f81a183bf55218a08e4ece43081804f5b438","observation_id":"a3686d76-ead4-4241-b460-ee9eebcd86b5","resolution":{"observed_at":"2026-08-07T00:42:05.703761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.691218Z","title":"Benchmarking automated program repair: An extensive study on both real-world and artificial bugs,","venue":null,"work_id":"a59ff6cd-9cd1-454b-80f3-bf99bdb52356","year":2024},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.463552Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:4ba54354d900f21007ef2be149a822858c683722abfbb1800d753e0cd2135090","observation_id":"55508178-2240-479c-b518-8719019d69cd","resolution":{"observed_at":"2026-08-07T00:42:05.694450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.681885Z","title":"A large-scale empirical review of patch correctness checking approaches,","venue":null,"work_id":"7faad397-193a-40cb-b7cf-28bc104faf40","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.466363Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:cce6862e9579e56a8d07b98a9c54cbfc793a925c7c186a20863f8e98736cc591","observation_id":"3742ddc5-6f61-4290-956f-49029b7ae247","resolution":{"observed_at":"2026-08-07T00:42:05.684923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.671989Z","title":"Fine-grained and accurate source code differencing,","venue":null,"work_id":"2f379b41-0d1e-473c-b116-0de92a4c5ed2","year":2014},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.469686Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:db53ef3c32ce805af5d8aa297ef33d41aa7cd6b73fa224287de75d61b69b30b1","observation_id":"22b224c3-c84b-4ba9-be58-302809035acd","resolution":{"observed_at":"2026-08-07T00:42:05.675707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.660574Z","title":"Hyperparameter optimiza- tion for ast differencing,","venue":null,"work_id":"a28d22d3-0ae5-4e3d-8f3f-015d5c4f6d6e","year":2023},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.472880Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:bc133e75cb477496d7d1e7a42353ec7bffe7b196607ec6eee556f9bf07c262cf","observation_id":"31906295-cc80-4353-beac-7113e8e9715b","resolution":{"observed_at":"2026-08-07T00:42:05.665562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.454169Z","title":"Available: https://proceedings.neurips.cc/paper files/ paper/2020/file/1457c0d6bfcb4967418bfb8ac142f64a-Paper.pdf","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":1901,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.454169Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:e2417ff8625f6eef7ad19433514fd25499e84d8964809cb0c30fee527e410715","observation_id":"e5d92750-57d9-4d2c-a8aa-24c3189299a2","resolution":{"observed_at":"2026-08-07T00:42:05.454169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:05.756007Z","title":"Available: https://proceedings.neurips.cc/paper/2022/ hash/9d5609613524ecf4f15af0f7b31abca4-Abstract-Conference.html","venue":null,"work_id":"f51506c3-b95b-483f-82ed-21683d3f5519","year":2022},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:05.438664Z"},"links":{"citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:58def05701836577852336eed29de07391b8c08970d57f2941f3f914686c8163","observation_id":"59f72b53-4217-48de-9a4c-7f0376aba95d","resolution":{"observed_at":"2026-08-07T00:42:05.758987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":56},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 2 inbound Pith citation observations for arXiv:2506.13186."}