{"as_of":"2026-08-07T18:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ee64fe3fc13395c7cf3d717b3e26497094378680d4a30f3585cc810e467fc4f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:00:46.169447Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T09:39:46.017724Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2302.06527","last_updated":"2023-12-11T11:50:51Z","snapshot_observed_at":"2026-07-06T14:51:19.104522Z","submitted_at":"2023-02-13T17:13:41Z","title":"An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation","version":4},"cited_work":{"arxiv_id":"2302.06527","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.06527","snapshot_observed_at":"2026-07-04T09:39:46.017724Z","title":"arXiv preprint arXiv:2302.06527 , volume =","venue":null,"work_id":"46c5e92e-727d-40f2-86a3-988910e5a938","year":2023},"citing_paper":{"arxiv_id":"2407.01489","last_updated":"2024-10-29T17:29:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-01T17:24:45Z","title":"Agentless: Demystifying LLM-based Software Engineering Agents","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-12T05:12:22.013365Z"},"links":{"cited_paper":"/paper/2302.06527","citing_paper":"/paper/2407.01489"},"observation_digest":"sha256:621f5c9165234325704eb553cf0c9cc905cb23148af1b5d8cf217d86d6246b71","observation_id":"1712bd60-e7f5-4c76-98f3-c4bc8c94dd7a","resolution":{"observed_at":"2026-05-12T05:12:22.208403Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06527","last_updated":"2023-12-11T11:50:51Z","snapshot_observed_at":"2026-07-06T14:51:19.104522Z","submitted_at":"2023-02-13T17:13:41Z","title":"An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation","version":4},"cited_work":{"arxiv_id":"2302.06527","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.06527","snapshot_observed_at":"2026-07-04T09:39:46.017724Z","title":"arXiv preprint arXiv:2302.06527 , volume =","venue":null,"work_id":"46c5e92e-727d-40f2-86a3-988910e5a938","year":2023},"citing_paper":{"arxiv_id":"2502.18917","last_updated":"2025-06-10T22:11:53Z","snapshot_observed_at":"2026-08-03T02:17:55.804921Z","submitted_at":"2025-02-26T08:10:57Z","title":"ClassInvGen: Class Invariant Synthesis using Large Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-23T02:42:59.190220Z"},"links":{"cited_paper":"/paper/2302.06527","citing_paper":"/paper/2502.18917"},"observation_digest":"sha256:6c3461e3e652840df9bd436fe8f06be87171df87c9ec37d382c69dda5674bb9c","observation_id":"2b851e5b-7267-48e4-b9cb-623ac4ee0f19","resolution":{"observed_at":"2026-05-23T02:45:19.500051Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06527","last_updated":"2023-12-11T11:50:51Z","snapshot_observed_at":"2026-07-06T14:51:19.104522Z","submitted_at":"2023-02-13T17:13:41Z","title":"An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06527","snapshot_observed_at":"2026-08-07T11:00:46.169447Z","title":"Adaptive test generation using a large language model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11081","last_updated":"2025-06-04T08:44:25Z","snapshot_observed_at":"2026-08-07T10:54:29.102647Z","submitted_at":"2025-06-04T08:44:25Z","title":"SAGE:Specification-Aware Grammar Extraction for Automated Test Case Generation with LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:00:46.169447Z"},"links":{"cited_paper":"/paper/2302.06527","citing_paper":"/paper/2506.11081"},"observation_digest":"sha256:d7f1b7414c7b383bace50db06d652a721628f3201a10fefb9bc4617b1844da88","observation_id":"48c9b081-415b-456b-b727-1b4e39ad7f61","resolution":{"observed_at":"2026-08-07T11:00:46.169447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06527","last_updated":"2023-12-11T11:50:51Z","snapshot_observed_at":"2026-07-06T14:51:19.104522Z","submitted_at":"2023-02-13T17:13:41Z","title":"An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06527","snapshot_observed_at":"2026-08-06T19:34:36.206618Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05200","last_updated":"2025-07-07T17:01:17Z","snapshot_observed_at":"2026-08-07T03:53:01.367546Z","submitted_at":"2025-07-07T17:01:17Z","title":"In-Context Learning as an Effective Estimator of Functional Correctness of LLM-Generated Code","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:34:36.206618Z"},"links":{"cited_paper":"/paper/2302.06527","citing_paper":"/paper/2507.05200"},"observation_digest":"sha256:803b46d5a8477ea7441d0afb8be1684ba676e6d64f3a00f9580602e85fda220c","observation_id":"8a28d386-ebd3-4d15-a633-93225a0871ff","resolution":{"observed_at":"2026-08-06T19:34:36.206618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06527","last_updated":"2023-12-11T11:50:51Z","snapshot_observed_at":"2026-07-06T14:51:19.104522Z","submitted_at":"2023-02-13T17:13:41Z","title":"An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation","version":4},"cited_work":{"arxiv_id":"2302.06527","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.06527","snapshot_observed_at":"2026-07-04T09:39:46.017724Z","title":"arXiv preprint arXiv:2302.06527 , volume =","venue":null,"work_id":"46c5e92e-727d-40f2-86a3-988910e5a938","year":2023},"citing_paper":{"arxiv_id":"2603.27098","last_updated":"2026-04-04T02:18:57Z","snapshot_observed_at":"2026-08-02T12:17:19.632566Z","submitted_at":"2026-03-28T02:37:36Z","title":"Ensemble-Based Uncertainty Estimation for Code Correctness Estimation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-14T22:52:58.524934Z"},"links":{"cited_paper":"/paper/2302.06527","citing_paper":"/paper/2603.27098"},"observation_digest":"sha256:1543a252f93056fc69d73d9fc5420f26896289b01f16a58d8c41c19715b8eec7","observation_id":"c91c5c03-7346-42f6-a3b8-54024eb54703","resolution":{"observed_at":"2026-05-14T22:53:14.206666Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06527","last_updated":"2023-12-11T11:50:51Z","snapshot_observed_at":"2026-07-06T14:51:19.104522Z","submitted_at":"2023-02-13T17:13:41Z","title":"An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation","version":4},"cited_work":{"arxiv_id":"2302.06527","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.06527","snapshot_observed_at":"2026-07-04T09:39:46.017724Z","title":"arXiv preprint arXiv:2302.06527 , volume =","venue":null,"work_id":"46c5e92e-727d-40f2-86a3-988910e5a938","year":2023},"citing_paper":{"arxiv_id":"2604.19826","last_updated":"2026-04-20T14:47:46Z","snapshot_observed_at":"2026-07-06T23:06:26.596990Z","submitted_at":"2026-04-20T14:47:46Z","title":"Co-Located Tests, Better AI Code: How Test Syntax Structure Affects Foundation Model Code Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T04:21:39.637962Z"},"links":{"cited_paper":"/paper/2302.06527","citing_paper":"/paper/2604.19826"},"observation_digest":"sha256:cb422c589e0a084d8e6b379030de2751244ddd41c61486f676f52404f8793742","observation_id":"b9649ee5-71c1-4e4a-a400-7d2ad476d253","resolution":{"observed_at":"2026-05-11T12:01:05.166984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06527","last_updated":"2023-12-11T11:50:51Z","snapshot_observed_at":"2026-07-06T14:51:19.104522Z","submitted_at":"2023-02-13T17:13:41Z","title":"An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation","version":4},"cited_work":{"arxiv_id":"2302.06527","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.06527","snapshot_observed_at":"2026-07-04T09:39:46.017724Z","title":"arXiv preprint arXiv:2302.06527 , volume =","venue":null,"work_id":"46c5e92e-727d-40f2-86a3-988910e5a938","year":2023},"citing_paper":{"arxiv_id":"2604.24450","last_updated":"2026-04-27T13:17:13Z","snapshot_observed_at":"2026-08-05T23:03:03.867612Z","submitted_at":"2026-04-27T13:17:13Z","title":"On the Footprints of Reviewer Bots Feedback on Agentic Pull Requests in OSS GitHub Repositories","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T03:18:15.635912Z"},"links":{"cited_paper":"/paper/2302.06527","citing_paper":"/paper/2604.24450"},"observation_digest":"sha256:a59e6aef33139e316938096d89804d3aa54cfd99507216f24e41efbf4e05e014","observation_id":"e26f4893-de0b-4bfe-bf50-c48c80eef25e","resolution":{"observed_at":"2026-05-11T22:11:13.536297Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06527","last_updated":"2023-12-11T11:50:51Z","snapshot_observed_at":"2026-07-06T14:51:19.104522Z","submitted_at":"2023-02-13T17:13:41Z","title":"An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation","version":4},"cited_work":{"arxiv_id":"2302.06527","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.06527","snapshot_observed_at":"2026-07-04T09:39:46.017724Z","title":"arXiv preprint arXiv:2302.06527 , volume =","venue":null,"work_id":"46c5e92e-727d-40f2-86a3-988910e5a938","year":2023},"citing_paper":{"arxiv_id":"2605.03356","last_updated":"2026-05-05T04:29:38Z","snapshot_observed_at":"2026-08-06T23:24:38.436110Z","submitted_at":"2026-05-05T04:29:38Z","title":"POSTCONDBENCH: Benchmarking Correctness and Completeness in Formal Postcondition Inference","version":1},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-05-07T16:04:48.394294Z"},"links":{"cited_paper":"/paper/2302.06527","citing_paper":"/paper/2605.03356"},"observation_digest":"sha256:b6eae5d4917453ad7c9c3a82838f2cb5175b346ddf8ed133339e8cb3081a8320","observation_id":"552330ad-5cb7-4f50-85b6-6518eca05289","resolution":{"observed_at":"2026-05-11T23:56:12.277153Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06527","last_updated":"2023-12-11T11:50:51Z","snapshot_observed_at":"2026-07-06T14:51:19.104522Z","submitted_at":"2023-02-13T17:13:41Z","title":"An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation","version":4},"cited_work":{"arxiv_id":"2302.06527","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.06527","snapshot_observed_at":"2026-07-04T09:39:46.017724Z","title":"arXiv preprint arXiv:2302.06527 , volume =","venue":null,"work_id":"46c5e92e-727d-40f2-86a3-988910e5a938","year":2023},"citing_paper":{"arxiv_id":"2606.22704","last_updated":"2026-06-21T22:45:33Z","snapshot_observed_at":"2026-08-06T16:12:32.105061Z","submitted_at":"2026-06-21T22:45:33Z","title":"VeriPort: Automated and Verified Patch Backporting at Scale","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T09:47:51.579030Z"},"links":{"cited_paper":"/paper/2302.06527","citing_paper":"/paper/2606.22704"},"observation_digest":"sha256:c5015af42a5b3c81b41b583270ce18708831bb9048bf7027c57b55014574a90a","observation_id":"9aaecfb4-8b5c-412b-b79b-ed880090ad83","resolution":{"observed_at":"2026-07-04T09:39:46.019260Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06527","last_updated":"2023-12-11T11:50:51Z","snapshot_observed_at":"2026-07-06T14:51:19.104522Z","submitted_at":"2023-02-13T17:13:41Z","title":"An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06527","snapshot_observed_at":"2026-08-01T03:57:40.753104Z","title":"No More Manual Tests? Evaluating and Improving ChatGPT for Unit Test Generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23002","last_updated":"2026-07-25T02:38:07Z","snapshot_observed_at":"2026-08-07T04:25:52.607572Z","submitted_at":"2026-07-25T02:38:07Z","title":"Adversarial Test-Hardening for AI-Written Code: An Instrument Autopsy and a Pre-Registered Causal Estimate of the Critic Loop","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T03:57:40.753104Z"},"links":{"cited_paper":"/paper/2302.06527","citing_paper":"/paper/2607.23002"},"observation_digest":"sha256:9e290b163c70226b4305021a6352c2fd733e750218332a9ed51340bd299fb4c9","observation_id":"693eb81b-ba9b-48e2-aa95-db5bfc04361a","resolution":{"observed_at":"2026-08-01T03:57:40.753104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2302.06527/citation-record","integrity":"/paper/2302.06527/integrity","json":"/paper/2302.06527/citation-record.json","paper":"/paper/2302.06527"},"outbound":[],"paper":{"arxiv_id":"2302.06527","last_updated":"2023-12-11T11:50:51Z","latest_version":4,"primary_category":"cs.SE","snapshot_observed_at":"2026-07-06T14:51:19.104522Z","submitted_at":"2023-02-13T17:13:41Z","title":"An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2302.06527."}