{"as_of":"2026-08-09T04:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7c3f02b28a6e43bcb3886ab7a4007b7409c9dd44caca6171045260df07a4ff9f","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:01:12.457223Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T10:50:14.360577Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"cited_work":{"arxiv_id":"2502.07046","doi":"10.48550/arxiv.2502.07046","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07046","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"ArXiv.org","work_id":"9184fea9-7960-4af2-b065-02a2483add71","year":2025},"citing_paper":{"arxiv_id":"2605.28482","last_updated":"2026-05-27T13:41:05Z","snapshot_observed_at":"2026-07-06T23:38:04.621658Z","submitted_at":"2026-05-27T13:41:05Z","title":"Rethinking Software Empirical Studies with Structural Causal Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T10:50:14.360577Z"},"links":{"cited_paper":"/paper/2502.07046","citing_paper":"/paper/2605.28482"},"observation_digest":"sha256:2879ff9e0f196f25d9463b01951f5a6cea71b7f3908df5de882e012713903862","observation_id":"c4ba8229-943c-4ad3-b94a-4a0c14c37024","resolution":{"observed_at":"2026-06-29T10:53:18.894445Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07046/citation-record","integrity":"/paper/2502.07046/integrity","json":"/paper/2502.07046/citation-record.json","paper":"/paper/2502.07046"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.852614Z","title":"Program synthesis with large language models,","venue":null,"work_id":"303e4671-8193-4ea7-a434-b106cc123b78","year":2021},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.317899Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:29d7b67c0d4423cc109c82c2951de2bfed092f97df65b002b4152cde5e875ca9","observation_id":"e549b6eb-122e-4bbe-8c47-980bb696e690","resolution":{"observed_at":"2026-08-08T14:01:12.855591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.09938","last_updated":"2021-11-08T21:16:44Z","snapshot_observed_at":"2026-08-04T23:13:25.514661Z","submitted_at":"2021-05-20T17:58:42Z","title":"Measuring Coding Challenge Competence With APPS","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.09938","snapshot_observed_at":"2026-08-08T14:01:12.321790Z","title":"Measuring coding chal- lenge competence with APPS,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.321790Z"},"links":{"cited_paper":"/paper/2105.09938","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:fbbf213c224cb7a26c68f922145237bcab79fa9635d10c9a58bb137cfae4e833","observation_id":"627bea92-fe23-420e-8128-0a52f777cb2e","resolution":{"observed_at":"2026-08-08T14:01:12.321790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.844415Z","title":"Generation Probabilities are Not Enough: Improving Error Highlighting for AI Code Suggestions,","venue":null,"work_id":"2f59ae04-bead-47d8-947b-46ea30d85a78","year":2021},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.325393Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:f7ccf2c09cb9123dfa6f9184720d74fb3bbb189198652d374c278e00cf39d4d1","observation_id":"fbb2e48f-1b78-4429-8aa2-6ff820d2cba6","resolution":{"observed_at":"2026-08-08T14:01:12.847526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.836281Z","title":"Toward deep learn- ing software repositories,","venue":null,"work_id":"9cdb9025-332b-48ab-8828-f37453f5316a","year":2015},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.328773Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:0f24c5a78143423063b1b544aabf44ca567af7484859642c8c6b3a45718b96ab","observation_id":"ba42146a-0da8-4e85-af22-7ba81e7a3444","resolution":{"observed_at":"2026-08-08T14:01:12.839249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.828234Z","title":"An empirical study on the usage of transformer models for code completion,","venue":null,"work_id":"c5fe8659-4026-4a4e-a43e-99ad4aefa6d7","year":2022},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.331809Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:ae92f8bfab2e8d84c8452ec3a532173ba76220bc8720258abf5273255656c9fa","observation_id":"0c89a7f6-5214-434e-8665-4f5642d15c73","resolution":{"observed_at":"2026-08-08T14:01:12.831304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.11423","last_updated":"2021-07-23T19:12:55Z","snapshot_observed_at":"2026-08-04T09:02:38.870146Z","submitted_at":"2021-07-23T19:12:55Z","title":"Ensemble Models for Neural Source Code Summarization of Subroutines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.11423","snapshot_observed_at":"2026-08-08T14:01:12.335003Z","title":"Ensemble Models for Neural Source Code Summarization of Subroutines,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.335003Z"},"links":{"cited_paper":"/paper/2107.11423","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:f55351316dd34a3d836a1ad07ed186b64500a3ca987f0d27b7a759a48f4279df","observation_id":"52654754-43dc-4f5a-b60a-5d83d7546614","resolution":{"observed_at":"2026-08-08T14:01:12.335003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.819981Z","title":"An empirical investigation into the use of image captioning for automated software documentation,","venue":null,"work_id":"5a8d9d68-6caf-4e48-bc0c-5a644bec47e8","year":2022},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.339025Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:88a9046b9075e605b29be6437884563fb696b0102feaa44103fb13c441bf21de","observation_id":"4d2e308e-6efc-4304-9136-a9641a29ca55","resolution":{"observed_at":"2026-08-08T14:01:12.823210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.811738Z","title":"Towards automating code review activities,","venue":null,"work_id":"33578336-9692-462e-bda0-844f268cccb1","year":2021},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.341898Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:8c35fac1a73fe59b3af576f4d56111efb457926198551e0c0a6f86c11fdc2201","observation_id":"12dc398b-42a0-4143-b978-68e46444eac7","resolution":{"observed_at":"2026-08-08T14:01:12.814741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.803363Z","title":"Using pre-trained models to boost code review automation,","venue":null,"work_id":"bf7cc05f-72fa-4e67-90ba-62c0c4d29364","year":2022},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.344945Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:6106da77d8445ae36511921e3837b1f98d2bd025dd1282ed52ecfec7baecbc78","observation_id":"8d721078-d1df-42cc-b401-bbb5cfab17b5","resolution":{"observed_at":"2026-08-08T14:01:12.806452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.794646Z","title":"Graph-based statistical language model for code,","venue":null,"work_id":"fc837b52-fc93-42e5-a968-8e6f10224be3","year":2015},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.348072Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:d0f4ab3276efc76dcfa6f91d6fea66ddf4fd2607aef6274886dcfd03da2072da","observation_id":"648031ad-24a5-4bf4-a10a-1b7ef5f1f1fe","resolution":{"observed_at":"2026-08-08T14:01:12.797909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.786113Z","title":"Deep learning code frag- ments for code clone detection,","venue":null,"work_id":"7a90902e-0ee1-4a68-9c4d-1e2a6e2287f6","year":2016},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.351263Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:e616f718b7f6542c68ea4141700090ba9a2114e086969e0b72f81993071cc123","observation_id":"1d188841-42e5-4dbe-87e8-6b686307aa49","resolution":{"observed_at":"2026-08-08T14:01:12.789337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.777514Z","title":"Deep learning similarities from different representations of source code,","venue":null,"work_id":"24d5b766-1aa8-4d1e-9f47-fb069d4499d4","year":2018},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.354261Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:22c67932a63013ab269dd9307b10be76d3728d0560cbeed4eb3ece6054ed2359","observation_id":"cac84f54-1073-4b10-bac2-d459e26cccc1","resolution":{"observed_at":"2026-08-08T14:01:12.780693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.769581Z","title":"Learning How to Mutate Source Code from Bug-Fixes,","venue":null,"work_id":"d38320fd-2f2f-4f05-afe5-20f2a3d74bb4","year":2019},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.357296Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:45f71b0c598dda2508e9c156b6714f84258e3eb9f419f795cb38a42552672e36","observation_id":"c958bb6b-00b9-438a-bc7e-b349b0e1d0ea","resolution":{"observed_at":"2026-08-08T14:01:12.772214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.762038Z","title":"Devign: Effective Vulnerability Identification by Learning Comprehensive Program Semantics via Graph Neural Networks","venue":null,"work_id":"f7d50e0c-e6c9-459f-82b8-0c069c73b9e3","year":null},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.360109Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:e8565f0d44f0761baba18630487d9af6b1275685aee7b7701bcac35646d14d78","observation_id":"743d9a33-e385-48e1-9269-4adc81c056c7","resolution":{"observed_at":"2026-08-08T14:01:12.764831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.754961Z","title":"Sorting and transforming program repair ingredients via deep learning code similarities,","venue":null,"work_id":"df65a514-ec00-4e49-8628-e808c2ef3651","year":2019},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.362919Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:f935529e880d3fea437a31281e6cfa0dafc49400c2abd1f986a858e3d1db3fd9","observation_id":"0a7dd488-7b95-4e0d-982a-dddbef8bbb5b","resolution":{"observed_at":"2026-08-08T14:01:12.757722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.747987Z","title":"On learning meaningful code changes via neural machine translation,","venue":null,"work_id":"f525d537-8558-4917-9d99-02db92c38582","year":2019},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.365814Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:ec55d3ea4c47dd77e3dfab63e15f604acc84e29e662757912a7ef78893489b8d","observation_id":"62efcdd7-7bfe-4cb8-87a6-8c0c1589f4c1","resolution":{"observed_at":"2026-08-08T14:01:12.750565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.739812Z","title":"An empirical investigation into learning bug-fixing patches in the wild via neural machine transla- tion,","venue":null,"work_id":"4718f2f4-6236-42a7-8438-146a33f57a97","year":2018},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.369104Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:b3cb99f80436ffd904be8c82d22cb831394120fbe2be912a4bdd1845f1db24d6","observation_id":"d5b5bc12-6269-4d07-8ee4-3a76101d7ecd","resolution":{"observed_at":"2026-08-08T14:01:12.743029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.731907Z","title":"Sequencer: Sequence-to- sequence learning for end-to-end program repair,","venue":null,"work_id":"313aa8ff-0a7c-489a-b1ee-7fd91218a729","year":1943},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.371967Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:77ff0030158cdc16ab8bee4fece25927cd0d8cc9e3eeda7f221da2936c008621","observation_id":"c22a15ef-5992-42a4-b924-986b094b1b45","resolution":{"observed_at":"2026-08-08T14:01:12.734900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.723798Z","title":"Can we automatically fix bugs by learning edit operations?","venue":null,"work_id":"d30fecf0-c88a-4115-8eea-44755e4ef00c","year":2022},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.374894Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:14ec9fb1445da196675f7b630c08ee269b13e330af653eb8a17c1932e1b22d9c","observation_id":"43bf6bc3-fa57-42ce-905a-037364a08a95","resolution":{"observed_at":"2026-08-08T14:01:12.726932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-08T14:01:12.377875Z","title":"LiveCodeBench: Holistic and Contami- nation Free Evaluation of Large Language Models for Code,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.377875Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:db58d34ade3292924fc23eebf7d79c9ca1ec83699d7d779e0512e67a37c04888","observation_id":"232d3b32-1fd6-42e8-a811-a39ef26d941c","resolution":{"observed_at":"2026-08-08T14:01:12.377875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-08T14:01:12.381200Z","title":"Emergent Abilities of Large Language Models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.381200Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:b86c9883ceabd10427fe08d6ea769e1e25d6bff2a29bdcfc6040e834ed3ec2c1","observation_id":"85cfc176-7a88-417c-977d-174c50ca1519","resolution":{"observed_at":"2026-08-08T14:01:12.381200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01910","last_updated":"2023-03-10T17:20:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-03T15:43:03Z","title":"Large Language Models Are Human-Level Prompt Engineers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01910","snapshot_observed_at":"2026-08-08T14:01:12.384421Z","title":"Large language models are human-level prompt engineers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.384421Z"},"links":{"cited_paper":"/paper/2211.01910","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:ef1970bead3390fbb3a5b8df09851bdf934d2c737f1f16139fb48a2982eb9c1f","observation_id":"fa58b265-1fcd-481d-81d5-e6219a1d7561","resolution":{"observed_at":"2026-08-08T14:01:12.384421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.07839","last_updated":"2023-03-11T14:43:17Z","snapshot_observed_at":"2026-07-06T15:03:08.992538Z","submitted_at":"2023-03-11T14:43:17Z","title":"ChatGPT Prompt Patterns for Improving Code Quality, Refactoring, Requirements Elicitation, and Software Design","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.07839","snapshot_observed_at":"2026-08-08T14:01:12.387530Z","title":"Chatgpt prompt patterns for improving code quality, refactoring, requirements elicitation, and software design,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.387530Z"},"links":{"cited_paper":"/paper/2303.07839","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:08db3e39195013e773333be7482c5d4bf1e7f4a86f12065acce60015b3419a37","observation_id":"ea4ce8c4-ef9a-4972-b61d-cf7ce44a1912","resolution":{"observed_at":"2026-08-08T14:01:12.387530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.715679Z","title":"Prompting is pro- gramming: A query language for large language models,","venue":null,"work_id":"baaf9656-dbbe-4538-862d-abeff6ef2c09","year":2023},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.389977Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:1fa0800937b9877625c92b732987a00200be9b27db6acc0f82cec3d2a3708df7","observation_id":"fd2e0075-22fd-44bc-b65c-525916c9cb43","resolution":{"observed_at":"2026-08-08T14:01:12.718792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-08T14:01:12.392293Z","title":"Chain-of-Thought Prompt- ing Elicits Reasoning in Large Language Models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.392293Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:ee9a95d4e36e0900872e53e9df88268b4172281e37e2878d60f9d1e5dcf1e158","observation_id":"e6162be5-a1b5-46fa-a534-8623ffd99656","resolution":{"observed_at":"2026-08-08T14:01:12.392293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.14279563","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.476547Z","title":"Snipgen tesbed to evaluate llms for code,","venue":null,"work_id":"1adadeb2-4241-42ef-990a-ead40157f5bd","year":2025},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.394907Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:b4527b61105051bae62332796c6cfd85387d16d1151bb5ff906d309aeb31e73b","observation_id":"d749fdad-591b-4578-a88c-cca7b4163a69","resolution":{"observed_at":"2026-08-08T14:01:12.482855Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.706873Z","title":"Snipgen: A code snippet generation tool,","venue":null,"work_id":"3718228d-3894-425b-ae9c-56f2563ff181","year":2025},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.397208Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:87f23c223dc8f77abf1e843fb838f12292c7d600b669fd3ba01c54a83a7ec356","observation_id":"fcb16e30-ae86-4a1a-b59a-06772d4a1bab","resolution":{"observed_at":"2026-08-08T14:01:12.710018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.697847Z","title":"Pydriller documentation,","venue":null,"work_id":"e5894ef5-b90d-4a2a-a08f-b4922943ce48","year":2024},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.399587Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:cdcb9a93e90d3f6ca3ec3fd5bdd7bf5b6f1f777eb06a535e031d6ea9810a3c08","observation_id":"56e3ee4d-43fd-4146-8f97-3fd0d14f1fa2","resolution":{"observed_at":"2026-08-08T14:01:12.701059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.688828Z","title":"Tree-sitter documentation,","venue":null,"work_id":"ee8c6392-142e-4b60-ba37-78c6c4729712","year":2024},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.401686Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:7132f8626d417451e30a7adf6881d890e29e58beb7190eace87638ea11eb6972","observation_id":"a8369563-d86b-4acf-8882-448a41fbb003","resolution":{"observed_at":"2026-08-08T14:01:12.692135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.680190Z","title":"About codeql,","venue":null,"work_id":"4a0f4676-56ab-4dd9-80b2-05d9b4ae7508","year":2024},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.404429Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:66047f00533a9334e8609b364c8b25ae0050c4dd8f03cc76d3fed8da703cbfa5","observation_id":"bfebb0c8-4613-453c-bf97-79bb0d2ac785","resolution":{"observed_at":"2026-08-08T14:01:12.683199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.670984Z","title":"Benchmarking Causal Study to Interpret Large Language Models for Source Code ,","venue":null,"work_id":"cad7182a-82f9-47cc-8bb0-965c8d287615","year":2023},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.407372Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:83c3b47a392837ae9a1460e7d9cdddf26a093361bfcf57241eecc9fad568eca2","observation_id":"22134da6-9649-4776-8533-226a5a4b12ee","resolution":{"observed_at":"2026-08-08T14:01:12.674137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03873","last_updated":"2023-08-07T18:50:57Z","snapshot_observed_at":"2026-08-06T19:22:48.939625Z","submitted_at":"2023-08-07T18:50:57Z","title":"Evaluating and Explaining Large Language Models for Code Using Syntactic Structures","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03873","snapshot_observed_at":"2026-08-08T14:01:12.410126Z","title":"Evaluating and Explaining Large Language Models for Code Using Syntactic Structures,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.410126Z"},"links":{"cited_paper":"/paper/2308.03873","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:18833d29210a68c0d5a4cb83b9821b83295a191936f93a707ad9fed1063d73c7","observation_id":"c401808f-b9cf-480d-a32e-51f2c4517e13","resolution":{"observed_at":"2026-08-08T14:01:12.410126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.662399Z","title":"Which syn- tactic capabilities are statistically learned by masked language models for code?","venue":null,"work_id":"c99eb7e8-ca53-4fe3-a053-93feaea59d91","year":2024},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.413382Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:31beea2352aa2300213b76589d67e7664f9396024e925f231ff1285a57a8e469","observation_id":"0f8892f4-0837-450f-8868-1635f3f31192","resolution":{"observed_at":"2026-08-08T14:01:12.665595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08360","last_updated":"2023-05-15T05:37:33Z","snapshot_observed_at":"2026-08-06T03:54:25.053058Z","submitted_at":"2023-05-15T05:37:33Z","title":"Improving ChatGPT Prompt for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08360","snapshot_observed_at":"2026-08-08T14:01:12.416321Z","title":"Improving ChatGPT Prompt for Code Generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.416321Z"},"links":{"cited_paper":"/paper/2305.08360","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:29cc084f5a92b21e6eff5a355cac4f9dcb8dea44db27372e9ec59d788f3b6c8d","observation_id":"c1efbb6c-cb1f-4514-96e8-86aa6f5b7732","resolution":{"observed_at":"2026-08-08T14:01:12.416321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.654190Z","title":"The adverse effects of code duplication in machine learning models of code,","venue":null,"work_id":"ad49853f-a096-4dce-b9ca-37fd72573ed2","year":2019},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.419321Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:ce4604048268c7d1b0470bc04c2397da58dcc659ef33689e2ceec9bc0bfcabdd","observation_id":"d749108e-69a4-4cd6-999d-8c47cd006c01","resolution":{"observed_at":"2026-08-08T14:01:12.657461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.03341","last_updated":"2019-12-05T19:29:29Z","snapshot_observed_at":"2026-08-08T12:15:34.687355Z","submitted_at":"2019-09-07T21:29:46Z","title":"Neural Machine Translation with Byte-Level Subwords","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.03341","snapshot_observed_at":"2026-08-08T14:01:12.422294Z","title":"Neural Machine Translation with Byte- Level Subwords,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.422294Z"},"links":{"cited_paper":"/paper/1909.03341","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:c390f8d6ac088f1567e3367114060c65c41d8321ebed81a32d4fb97da9cee255","observation_id":"f2150d84-1ce6-4307-9ad2-ae70d62fcbfe","resolution":{"observed_at":"2026-08-08T14:01:12.422294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.645041Z","title":"DeepFix: Fixing Common C Lan- guage Errors by Deep Learning,","venue":null,"work_id":"134eabfb-4008-4fb6-a37a-6eff3c339179","year":2017},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.425423Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:a2ae5fe8260e9f95f64d083cc9b78a581b05b7b5b95c3d442c1b189c9de42b36","observation_id":"527efccc-b606-4180-a966-7477b8f46d41","resolution":{"observed_at":"2026-08-08T14:01:12.648167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.07814","last_updated":"2022-02-08T23:16:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-08T23:16:31Z","title":"Competition-Level Code Generation with AlphaCode","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.07814","snapshot_observed_at":"2026-08-08T14:01:12.428212Z","title":"Competition-Level Code Generation with AlphaCode,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.428212Z"},"links":{"cited_paper":"/paper/2203.07814","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:38fc4100811c3058d232b8b831735dc28f446d9f2c6ad9204dfe50a6d224337c","observation_id":"0c2ced99-c23b-4716-b273-a0bae037ae2d","resolution":{"observed_at":"2026-08-08T14:01:12.428212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.635990Z","title":"Learning to mine aligned code and natural language pairs from stack overflow,","venue":null,"work_id":"9afdcb1f-a4da-417b-b9fa-bb88af4327ca","year":2018},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.431422Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:8f309d89535800b5011ef3ea46420002d3be4e7cc8d374dcd3228bc16c0d03fc","observation_id":"8bcc5f02-d53e-4d94-8af1-9e0239b3333a","resolution":{"observed_at":"2026-08-08T14:01:12.639073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.09436","last_updated":"2020-06-08T09:09:28Z","snapshot_observed_at":"2026-08-06T10:54:14.530969Z","submitted_at":"2019-09-20T11:52:45Z","title":"CodeSearchNet Challenge: Evaluating the State of Semantic Code Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.09436","snapshot_observed_at":"2026-08-08T14:01:12.434210Z","title":"CodeSearchNet chal- lenge: Evaluating the state of semantic code search,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.434210Z"},"links":{"cited_paper":"/paper/1909.09436","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:6cd7efd434854e74faee06f2baee1d68cc56ef49c18e1c3849518bcea66c8435","observation_id":"7f3ce7ad-ddd1-4612-9437-6c045ac0699c","resolution":{"observed_at":"2026-08-08T14:01:12.434210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.628343Z","title":"CodeXGLUE: A machine learning benchmark dataset for code understanding and generation","venue":null,"work_id":"246588da-1cf8-422d-8325-89ac7423eedd","year":null},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.436909Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:e63263f540431e838bf098bac510142e763e95fdf28b042a3dd73c973b0d14ad","observation_id":"91dd3960-5656-44f9-ba0c-15cc4f72dc68","resolution":{"observed_at":"2026-08-08T14:01:12.630977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03004","last_updated":"2023-11-06T07:16:58Z","snapshot_observed_at":"2026-07-06T14:59:03.634181Z","submitted_at":"2023-03-06T10:08:51Z","title":"xCodeEval: A Large Scale Multilingual Multitask Benchmark for Code Understanding, Generation, Translation and Retrieval","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03004","snapshot_observed_at":"2026-08-08T14:01:12.439905Z","title":"xCodeEval: A Large Scale Multilingual Multitask Benchmark for Code Understanding, Generation, Translation and Retrieval,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.439905Z"},"links":{"cited_paper":"/paper/2303.03004","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:b436836fb8a1c23dbdec992f3dc7805023c9488a312127183c27d62c3cf04d77","observation_id":"3654f6d7-f90c-466c-828f-abdafcf93f54","resolution":{"observed_at":"2026-08-08T14:01:12.439905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-08T14:01:12.442830Z","title":"Evaluating Large Language Models Trained on Code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.442830Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:15b7ac5b25bca417c8852b9027d260f43a168d44b21ce7128aaa50e4139a1955","observation_id":"399c53c3-44ed-4d6c-bb98-a91f43602669","resolution":{"observed_at":"2026-08-08T14:01:12.442830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.620764Z","title":"Securityeval dataset: Mining vul- nerability examples to evaluate machine learning-based code generation techniques,","venue":null,"work_id":"f502d233-d278-43b4-9b6a-de41aab781f2","year":2022},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.445823Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:14c54906a739632409e96576d9b1036eb550ab0131cfe89085bb4b57e4ad1e0e","observation_id":"becc6964-922b-42e5-9238-f71e1422b69f","resolution":{"observed_at":"2026-08-08T14:01:12.623591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.612999Z","title":"PythonSaga: Redefining the Benchmark to Evaluate Code Generating LLMs,","venue":null,"work_id":"ceadb143-8e5a-4833-abca-6e62383c2aeb","year":2024},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.448640Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:72a8c1580e10ac28df171fed486a58801dc7dc6f305beed5c81456241e91eede","observation_id":"319c41b6-aa47-4630-a892-4b22e56dd700","resolution":{"observed_at":"2026-08-08T14:01:12.615855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:01:12.603784Z","title":"Are large language models memorizing bug benchmarks?","venue":null,"work_id":"65d152b9-fdce-4207-a5c9-99bb8eadbcb1","year":2024},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.451357Z"},"links":{"citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:1c9c36e767fbcb50e4ac94177f408fecfe386e56a2edf9805b717ba0ec89fb5b","observation_id":"6e492ce9-3a89-4638-9537-b67e6e15c36e","resolution":{"observed_at":"2026-08-08T14:01:12.607310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08532","last_updated":"2025-05-01T11:56:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-15T16:50:09Z","title":"EvoPrompt: Connecting LLMs with Evolutionary Algorithms Yields Powerful Prompt Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08532","snapshot_observed_at":"2026-08-08T14:01:12.454141Z","title":"Connecting Large Language Models with Evolutionary Algorithms Yields Powerful Prompt Optimizers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.454141Z"},"links":{"cited_paper":"/paper/2309.08532","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:886e2e2db1ec275cdf1657b60773d0d4d963f47f049bf77691976b925fc3edb8","observation_id":"1c8586e3-95ca-4bfe-a1f3-7e21932a8abc","resolution":{"observed_at":"2026-08-08T14:01:12.454141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-08T14:01:12.457223Z","title":"WizardLM: Empowering Large Language Models to Follow Complex Instructions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T14:01:12.457223Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2502.07046"},"observation_digest":"sha256:f37aa900161ce42f084fe1fe63691fdb96232734e1763daa341c40efe56832f3","observation_id":"423530aa-55dd-4efb-94cf-49f57c412f30","resolution":{"observed_at":"2026-08-08T14:01:12.457223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.07046","last_updated":"2025-02-16T18:39:08Z","latest_version":2,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-08T13:55:05.151240Z","submitted_at":"2025-02-10T21:28:15Z","title":"SnipGen: A Mining Repository Framework for Evaluating LLMs for Code"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":31},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2502.07046."}