{"as_of":"2026-08-08T01:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1939cbb8c460ddebdc7319793b839f943ec888599c1b068cf3bf8ce6d73708a8","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:22:57.229784Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T17:37:51.790000Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T20:46:10.824386Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14297","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quality assessment of pythontestsgeneratedbylargelanguagemodels.arXivpreprint","venue":null,"work_id":"b4dc2e23-74c8-4788-a6e7-e803a13caaaa","year":2025},"citing_paper":{"arxiv_id":"2604.23340","last_updated":"2026-04-25T15:00:14Z","snapshot_observed_at":"2026-07-06T23:09:34.300163Z","submitted_at":"2026-04-25T15:00:14Z","title":"Can LLMs be Effective Code Contributors? A Study on Open-source Projects","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T08:09:33.211692Z"},"links":{"cited_paper":"/paper/2506.14297","citing_paper":"/paper/2604.23340"},"observation_digest":"sha256:4d1540742598a0600431d7da2b21e9fcb3cd382241422d7e36e42f52ca86bd94","observation_id":"039d6874-8fbe-4269-9744-543facd57397","resolution":{"observed_at":"2026-05-11T20:46:10.830944Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14297","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quality assessment of pythontestsgeneratedbylargelanguagemodels.arXivpreprint","venue":null,"work_id":"b4dc2e23-74c8-4788-a6e7-e803a13caaaa","year":2025},"citing_paper":{"arxiv_id":"2605.05267","last_updated":"2026-05-06T09:38:31Z","snapshot_observed_at":"2026-08-04T17:41:12.164736Z","submitted_at":"2026-05-06T09:38:31Z","title":"Bridging Generation and Training: A Systematic Review of Quality Issues in LLMs for Code","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T17:37:51.790000Z"},"links":{"cited_paper":"/paper/2506.14297","citing_paper":"/paper/2605.05267"},"observation_digest":"sha256:4f7c195f63e5391c0a53505fce89364d82075e31f0f9d9bdeeec47b38f09b331","observation_id":"a220b4a9-3197-41ba-95b2-36e94fffb31a","resolution":{"observed_at":"2026-05-11T17:26:04.393629Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.14297/citation-record","integrity":"/paper/2506.14297/integrity","json":"/paper/2506.14297/citation-record.json","paper":"/paper/2506.14297"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.10716","last_updated":"2024-01-19T14:27:44Z","snapshot_observed_at":"2026-08-01T23:48:18.444755Z","submitted_at":"2024-01-19T14:27:44Z","title":"Structured Code Representations Enable Data-Efficient Adaptation of Code Language Models","version":1},"cited_work":{"arxiv_id":"2401.10716","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.10716","snapshot_observed_at":"2026-08-07T00:23:00.472532Z","title":"Structured Code Representations Enable Data-Efficient Adaptation of Code Language Models","venue":"cs.CL","work_id":"0a1d4378-21b7-4ca8-a073-e20423d3a05c","year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:52.907011Z"},"links":{"cited_paper":"/paper/2401.10716","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:2e88d9c479e3c29633eea0dbf1e7c333f7347607047deed97711f3708e33b635","observation_id":"f2ce75d2-4b3d-4acf-8427-82c68f5519f3","resolution":{"observed_at":"2026-08-07T00:23:00.522246Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:52.956816Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:52.956816Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:b9b203ca142f8459ca8a8b5eabd1ce9e76a57276ad174054ffd748dd1ae967b4","observation_id":"2baf4883-dc09-4d31-ad66-46f3a5a069e6","resolution":{"observed_at":"2026-08-07T00:22:52.956816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.3561","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:00.296096Z","title":null,"venue":null,"work_id":"5fd4c35c-8d1b-4c42-b071-79d8b1f24c52","year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.166885Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:e34a9eb4b7cf705da689949c55461fb6c8450d8efaa1f60a085696a31cf00342","observation_id":"b74754e8-2605-493f-add0-a45212bee263","resolution":{"observed_at":"2026-08-07T00:23:00.320326Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:53.383429Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.383429Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:914835a551857e1d7321f27fdd5b59fc0825b66379c776c8cae09c80d62b48a4","observation_id":"c992e3e7-edcd-42eb-aa68-d3d4ea0763e0","resolution":{"observed_at":"2026-08-07T00:22:53.383429Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11528-023-00896-0","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:57.404265Z","title":null,"venue":null,"work_id":"43949605-c4e8-469e-b821-e1d599a8a166","year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.465341Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:632c304224289c467578f5a44452a60dc18976c18a8627f4659cc93f2ad637e7","observation_id":"a591b136-a682-4b39-8399-501e867fa2c6","resolution":{"observed_at":"2026-08-07T00:22:57.527939Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T00:22:53.528702Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.528702Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:4b7b9435142f363b2e7b3b0f87b24f3e4c17a68d4c711ca9a858e1da9199967b","observation_id":"3492489c-369f-471f-aa77-e76fca365e09","resolution":{"observed_at":"2026-08-07T00:22:53.528702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:53.620863Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.620863Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:eaca424d096d289e4a5211f1f05507613fb3bdcb323bee057e20d6ed8d8d67f1","observation_id":"7c700471-b715-4be9-932c-072a26a67464","resolution":{"observed_at":"2026-08-07T00:22:53.620863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:53.777526Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.777526Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:43d7b3aca51a71ad94da6316f336824c32a3595f93a8ba86e8c5cc49690894bd","observation_id":"f53d4363-7104-4d7a-be28-8c88d3f2c9e3","resolution":{"observed_at":"2026-08-07T00:22:53.777526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.3195","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:59.774096Z","title":null,"venue":null,"work_id":"a305aff4-b44c-4bb4-a760-2355f5cb63a6","year":2023},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.861129Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:10eb88bf95ad1a25c9cd657a47eac19b2c675c7d8a6ef5348244b8476a61954e","observation_id":"3dbac20d-5c75-4c0f-86c4-021eaf678633","resolution":{"observed_at":"2026-08-07T00:22:59.852913Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4032.36444","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:59.580621Z","title":null,"venue":null,"work_id":"ccd9b396-d4b3-49e6-9f57-5627a9b12bdb","year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:53.926091Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:eacd2378b3f61d961c16f1a845c5983f1307cad80f67f22787f4b5a6c96f801d","observation_id":"05025f6e-0f17-4f8f-9cf2-b90afd9365ab","resolution":{"observed_at":"2026-08-07T00:22:59.627204Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:54.000232Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.000232Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:868f3088982ee5efdc590434d3bdedc9d402372c3b0ed9aacb4997ef8c194e0f","observation_id":"f0773172-c8a0-4b84-ab6c-cc268ddd6c2d","resolution":{"observed_at":"2026-08-07T00:22:54.000232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:54.048447Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.048447Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:c0167021f9bdbfe89071f5472a93ffd316e0160e8cc0da73dc25da5f3c64d0da","observation_id":"6f2a4774-4e72-495a-88aa-4d5328114048","resolution":{"observed_at":"2026-08-07T00:22:54.048447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:54.117566Z","title":"Santos, Andrew Popovich, Mehdi Mirakhorli, and Mei Nagappan","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.117566Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:ae49504716bb294b81e3aeee7d9919c0ddc3d297dde1415ea479a9fd08e9b0e0","observation_id":"406b2339-ec23-49fb-ae9d-635d5e903e2f","resolution":{"observed_at":"2026-08-07T00:22:54.117566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:01.513412Z","title":"Graham, R","venue":null,"work_id":"c79667e3-50e4-4ba4-acfb-6492f5ec2073","year":2021},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.188448Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:001129e22b50038eb5f746f476f1829eb30d7e6acd692e07977c945bd8d84142","observation_id":"652449a9-dd3d-4787-b770-88486c2f2ec8","resolution":{"observed_at":"2026-08-07T00:23:01.553263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:01.491090Z","title":"2023.Code Correctness and Quality in the Era of AI Code Generation: Examining ChatGPT and GitHub Copilot","venue":null,"work_id":"4e0fbac0-7106-457c-b017-894261c83c1c","year":2023},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.285734Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:1473d8d2ce6a46e49a9afef47d2a67079ab43cf2a0fc002e5fc364b975ac96b8","observation_id":"4d2b26f3-3ec7-4b32-8016-91961208dc66","resolution":{"observed_at":"2026-08-07T00:23:01.495272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:01.332735Z","title":"Khorikov","venue":null,"work_id":"f0272b62-7d47-46b9-b05c-5a959fd9a01c","year":2020},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.290955Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:1a5b93e6aa99bbbc471da8ed21011ba22fafdc2c679ff545f38f48439331ac02","observation_id":"714c059f-df9c-4ebc-82a6-8e96fafcbce3","resolution":{"observed_at":"2026-08-07T00:23:01.388956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:01.243853Z","title":null,"venue":null,"work_id":"d7e840c0-8436-4ea0-9fcc-46023de369ff","year":2020},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.366203Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:f8035be53dada637c6832c71aef2c7ee3948b380084b6856af7c1a05aec1e98b","observation_id":"30ff293e-bddf-4993-aa49-e27b5f4f3b5f","resolution":{"observed_at":"2026-08-07T00:23:01.267075Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:54.510354Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.510354Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:656de2666c56723a2e90f1afc7495c629f9b97df2f153f772bbf8c97c904e006","observation_id":"733ac602-bcdc-44aa-8cb6-c23bccdb624f","resolution":{"observed_at":"2026-08-07T00:22:54.510354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:54.593557Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.593557Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:6328b9c21110755ce4abee388451dbc3d3521e0a547285e1279f83c58b146fbb","observation_id":"7b5b833e-b19b-4dc0-a875-998f9e59c5a5","resolution":{"observed_at":"2026-08-07T00:22:54.593557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04664","last_updated":"2021-03-16T08:28:37Z","snapshot_observed_at":"2026-07-06T10:39:42.676631Z","submitted_at":"2021-02-09T06:16:25Z","title":"CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.04664","snapshot_observed_at":"2026-08-07T00:22:54.681694Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.681694Z"},"links":{"cited_paper":"/paper/2102.04664","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:209a7ea80d95e5228c55b78ad656289d684522ccd4c51f4155e84092221a6928","observation_id":"e591b293-72b1-4234-9c51-0df5c84c48a8","resolution":{"observed_at":"2026-08-07T00:22:54.681694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1103.0125","last_updated":"2011-03-01T10:19:11Z","snapshot_observed_at":"2026-07-06T02:24:13.281199Z","submitted_at":"2011-03-01T10:19:11Z","title":"Search-based software test data generation using evolutionary computation","version":1},"cited_work":{"arxiv_id":"1103.0125","doi":null,"metadata_source":"pith","pith_arxiv_id":"1103.0125","snapshot_observed_at":"2026-08-07T00:22:59.021234Z","title":"Search-based software test data generation using evolutionary computation","venue":"cs.SE","work_id":"cd8ff83e-1602-453f-81d7-0ba4b1d26f66","year":2011},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.843366Z"},"links":{"cited_paper":"/paper/1103.0125","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:024788e494073a0d3e5b69e63fe4cc5d55feab05168155c7a24afcfdfa3f3c16","observation_id":"ac2fe842-4109-4667-8115-26f6bad1abd4","resolution":{"observed_at":"2026-08-07T00:22:59.126324Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:54.900003Z","title":"Marvin, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:54.900003Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:3ccef674486dd51101a403a040dd19c9a07e1e298d6e8179c5ea3cb1f3965d43","observation_id":"d7e546bd-95d7-4e47-9ef4-c4df30528740","resolution":{"observed_at":"2026-08-07T00:22:54.900003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:01.112214Z","title":null,"venue":null,"work_id":"e21b90f1-2ae3-493f-b992-f9344cbad77f","year":2004},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.164951Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:ae60b1d1326f676d331a776805b0b635a708936f0f596ac2a30fa0103a5a4e95","observation_id":"7f82476d-740b-4305-80da-8fb4cd17db78","resolution":{"observed_at":"2026-08-07T00:23:01.190255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.3563","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:58.818922Z","title":null,"venue":null,"work_id":"af3c9b53-a916-4d70-a951-9037b734a932","year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.292198Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:15c241a54e507dbf7347124d4c0037036f69ca5589325ae4a5ce3ae6059c79ee","observation_id":"2eae1305-74c4-4636-a1fb-1b625e8ab18a","resolution":{"observed_at":"2026-08-07T00:22:58.832867Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:55.412598Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.412598Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:b44091831329f7568fc1edc4cac815aa61e88cdf7c2985a7fe1f80850dc13752","observation_id":"11045527-012f-422f-8f98-653f9768ffc2","resolution":{"observed_at":"2026-08-07T00:22:55.412598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:55.499037Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.499037Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:cfcc621cfb0d43aec0b54659efa8651088cf2615eb45bff2e1e49e1ed3b1b726","observation_id":"45045dd9-da6f-4acb-b9dd-f5b383544d3f","resolution":{"observed_at":"2026-08-07T00:22:55.499037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:55.606582Z","title":"Becker, Arto Hellas, Bailey Kimmel, Garrett Powell, and Juho Leinonen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.606582Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:c7aed6255c2cbbfa5cea42db7b49da8fdeabe57ce50c1e614e9c1be4c7085c34","observation_id":"ef0d7043-afe7-4524-90f7-08061ce8e248","resolution":{"observed_at":"2026-08-07T00:22:55.606582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:55.733894Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.733894Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:b96353f6fe68cbfea93261788ab9d06931c23ff3b82701e7109fa968a7408b02","observation_id":"d8e185d7-c9ad-4032-97ed-2d9d2b5b99b6","resolution":{"observed_at":"2026-08-07T00:22:55.733894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07927","last_updated":"2025-03-16T06:23:34Z","snapshot_observed_at":"2026-08-05T17:55:26.008016Z","submitted_at":"2024-02-05T19:49:13Z","title":"A Systematic Survey of Prompt Engineering in Large Language Models: Techniques and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07927","snapshot_observed_at":"2026-08-07T00:22:55.803426Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.803426Z"},"links":{"cited_paper":"/paper/2402.07927","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:e2f2cfc89acc5d3039a571535cb458fdc8e2e566b50f4a093b5ec38670586b14","observation_id":"b5459b6b-81ea-482d-94b1-af2126f754a0","resolution":{"observed_at":"2026-08-07T00:22:55.803426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:00.968654Z","title":null,"venue":null,"work_id":"5ed3a65d-189c-4201-9a92-ac5655f630a9","year":2020},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.889640Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:f114426f0de1322d380ea9c39801bb1898535d83b60022c0acc96e149c4cb3e0","observation_id":"43a2ce56-4b73-4c8c-b842-8b7dc576f190","resolution":{"observed_at":"2026-08-07T00:23:01.023171Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:55.959286Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:55.959286Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:28b0005ebf8be5333f37e5130dc2509ed6e685e907e8647f0dca3959bf4aa418","observation_id":"8b96de58-5399-4419-ad44-ca45813a2857","resolution":{"observed_at":"2026-08-07T00:22:55.959286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/icst","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:58.099472Z","title":null,"venue":null,"work_id":"34c97b9e-a884-45be-b741-f00774268e4c","year":2018},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.099483Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:480621143f0595ecb90722cdfe736929b2b249783fe420aeda6969ce3d0a4265","observation_id":"b7803329-62f0-4a4b-871e-aff5426195d1","resolution":{"observed_at":"2026-08-07T00:22:58.159750Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1167.36612","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:00.086321Z","title":null,"venue":null,"work_id":"a733fd01-f677-429d-98c2-ca7350e4fb57","year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.206882Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:f830bcabd5f1599144f13fd8e067e024c575af74632bbb05426e0a0f84f1df4a","observation_id":"f630d06a-d59c-4f07-8e21-b1f445bbf636","resolution":{"observed_at":"2026-08-07T00:23:00.129940Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.05617","last_updated":"2021-05-20T23:11:01Z","snapshot_observed_at":"2026-07-06T09:54:57.110238Z","submitted_at":"2020-09-11T18:57:36Z","title":"Unit Test Case Generation with Transformers and Focal Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.05617","snapshot_observed_at":"2026-08-07T00:22:56.344629Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.344629Z"},"links":{"cited_paper":"/paper/2009.05617","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:abf7897340e3c251c5977971c61020696ac8c01c98a8cde6d761dbc5e19fb12e","observation_id":"a362e75d-eb7b-4d96-a0fe-f4c181f31073","resolution":{"observed_at":"2026-08-07T00:22:56.344629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:56.473597Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.473597Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:b87f6d7a05d0b6d43c80ae3f7a9e5602d7d9529983c4c5db8fab0bc39773500a","observation_id":"b5f5786d-522c-4a62-917c-d3003a413ac0","resolution":{"observed_at":"2026-08-07T00:22:56.473597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:00.848825Z","title":null,"venue":null,"work_id":"7b4db296-6068-4148-a460-fb0b64292cf8","year":2001},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.564574Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:6faf5cd9da5a3d3ceea0a9924e19c18f6452ad9c60296fbdbc58d89bc565a916","observation_id":"f45fb04c-3f11-425c-ac28-c4f22366833d","resolution":{"observed_at":"2026-08-07T00:23:00.923542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.96786","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:57.793435Z","title":null,"venue":null,"work_id":"c0aaa27b-dc00-4084-a379-50cef38ea598","year":2022},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.694578Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:bcbe586c69ac12455c350a47005b1294050fac716159d0ead55515b32212e0be","observation_id":"8f52b362-fb2f-43c2-9899-2532c4bca62b","resolution":{"observed_at":"2026-08-07T00:22:57.843768Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:56.791389Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.791389Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:b250b56621fea0ace8d11690c886dcab5974866061f0e22e0bb4a82bf9cbbe6c","observation_id":"4a8b768d-a97c-4a77-8ef5-bcbe7c4bc016","resolution":{"observed_at":"2026-08-07T00:22:56.791389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:00.703233Z","title":null,"venue":null,"work_id":"aaeb3e0d-7893-4f2d-b0d9-fcf91e3131db","year":2006},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:56.914404Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:51bc5ad63574f4bb12796362990a5de0124adf35fe291a9eefc7c5f61e950ecd","observation_id":"4a1f0b84-16fa-41e4-bf57-aae274d446a0","resolution":{"observed_at":"2026-08-07T00:23:00.781962Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:22:57.025241Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:57.025241Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:69bf04437403ec60e5a896e119409e7b958e04c80d46db627609a258db9c0a86","observation_id":"20852e48-d589-4406-8d08-7d1439c0ea86","resolution":{"observed_at":"2026-08-07T00:22:57.025241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10778","last_updated":"2023-10-22T01:48:39Z","snapshot_observed_at":"2026-07-06T15:18:14.909173Z","submitted_at":"2023-04-21T07:08:26Z","title":"Evaluating the Code Quality of AI-Assisted Code Generation Tools: An Empirical Study on GitHub Copilot, Amazon CodeWhisperer, and ChatGPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10778","snapshot_observed_at":"2026-08-07T00:22:57.143131Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:57.143131Z"},"links":{"cited_paper":"/paper/2304.10778","citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:04ad71438c8d3c6804653107f401a8a959035db8eff4eb4b3ef532080a9c22b5","observation_id":"9da3e49d-a12e-44d9-b41c-d7f49378169f","resolution":{"observed_at":"2026-08-07T00:22:57.143131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:00.571912Z","title":null,"venue":null,"work_id":"f088726c-eae1-45ff-a17c-21b13e396644","year":2023},"citing_paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:57.229784Z"},"links":{"citing_paper":"/paper/2506.14297"},"observation_digest":"sha256:f4a09cae4363f49a5daed0b454782d73e2717952279a743cadbc94b96d7331c5","observation_id":"32ddb553-d030-44a7-b15e-9ce263555191","resolution":{"observed_at":"2026-08-07T00:23:00.629614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.14297","last_updated":"2025-06-17T08:16:15Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-07T00:15:44.059229Z","submitted_at":"2025-06-17T08:16:15Z","title":"Quality Assessment of Python Tests Generated by Large Language Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":3,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":28,"verified_exact":5,"verified_fuzzy":3},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 2 inbound Pith citation observations for arXiv:2506.14297."}