{"as_of":"2026-08-21T11:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9fafe4ba7d59a877adc00655cb254bf964909a85179378ba8b7d9b826789fc8a","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T00:51:00.099499Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.06636/citation-record","integrity":"/paper/2607.06636/integrity","json":"/paper/2607.06636/citation-record.json","paper":"/paper/2607.06636"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":"2108.07732","doi":"10.1007/s11390-025-5518-5","metadata_source":"pith","pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Program Synthesis with Large Language Models","venue":"cs.PL","work_id":"fd241a05-03b9-4de2-9588-9d77ce176125","year":2021},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:f02f0a05f51dedbb995f42a98a107696920f3c51ba016279072ac9bc7f6c33ad","observation_id":"18ced049-54cc-44bf-bc4b-dfa73f6dbd16","resolution":{"observed_at":"2026-07-11T00:57:42.229796Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.723499Z","title":"Barr, Mark Harman, Phil McMinn, Muzammil Shahbaz, and Shin Yoo","venue":null,"work_id":"a5b95534-e2de-469f-8e4f-5d095e6d2499","year":2015},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:fbaf19637e2ba62967d3fab3a6abd9203517c34ed893386985d8ce50b08bc854","observation_id":"90c7f3e3-64d8-498e-b576-77bada4def34","resolution":{"observed_at":"2026-07-11T00:57:44.742097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.680707Z","title":"CodeT : Code generation with generated tests","venue":null,"work_id":"2e4b9909-1c7c-4254-8ee3-cc19e4b0270e","year":2023},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:78afc1f70773cba6c3054703662dca2bf93cf4e3155a1f141dafbab78995522d","observation_id":"807c3622-8771-43fa-a43e-2ec72e5c3cc3","resolution":{"observed_at":"2026-07-11T00:57:44.703171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:5e644e93d4ba7564d932167cb6009304b135e81c76c47dbdcfa7deba2b534247","observation_id":"fe755f8a-0428-42ba-813c-7b741e59448b","resolution":{"observed_at":"2026-07-11T00:57:42.209053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.725748Z","title":"Teaching large language models to self-debug","venue":null,"work_id":"2cebe456-fbca-45e8-95e9-ef2cbc70d575","year":2024},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:f8f4576f679b63aa8176ddfb85513cb380d1409a3788a4e3dc4a1d0d9765aa9d","observation_id":"a3ccc7b2-b11d-4d14-bf6c-7c921931fd59","resolution":{"observed_at":"2026-07-11T00:57:44.741578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.680248Z","title":"QuickCheck : A lightweight tool for random testing of Haskell programs","venue":null,"work_id":"9c93ae81-2d8b-4ab7-a39f-fb9bcc187fa4","year":2000},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:ff2a618c03acaabcd1b7e6535ca2e408bf62d0e357e70b51d6b059e47fc383de","observation_id":"f1ea7651-03d9-4a73-9fb4-9dcaf485e75b","resolution":{"observed_at":"2026-07-11T00:57:44.698325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.495214Z","title":"Selective classification for deep neural networks","venue":null,"work_id":"f8571798-e88f-42c2-8622-a4ab512c1321","year":2017},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:ea66efd7e0cfd236750d5690a4c2f9231508cc38a5e18d430505ccf0a8f51161","observation_id":"a8227cb4-ac82-4173-b9ef-77f670e0dccb","resolution":{"observed_at":"2026-07-11T00:57:44.511296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.743797Z","title":"Large language models cannot self-correct reasoning yet","venue":null,"work_id":"11a2c9e9-9394-4f22-bd86-4b84cfa79c4c","year":2024},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:4db90a53c85bb5a211f1ebd861bcaeb4f9f7c48217d4dba6ac89f5c23c081185","observation_id":"0fccd5ac-d18c-44ee-8079-a754ac592f49","resolution":{"observed_at":"2026-07-11T00:57:44.762344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.615026Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":"b280956a-5743-488d-b2e7-0825b0785ae8","year":2024},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:4f22d7c8f0071564215c486e106f36f624b88de47dbe1b720c046ebf07add952","observation_id":"ec7bdfc3-b19b-4762-86ec-ac971b864a55","resolution":{"observed_at":"2026-07-11T00:57:44.634363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.05950","last_updated":"2023-10-04T01:53:15Z","snapshot_observed_at":"2026-08-18T13:34:35.336328Z","submitted_at":"2022-08-11T17:41:08Z","title":"Interactive Code Generation via Test-Driven User-Intent Formalization","version":2},"cited_work":{"arxiv_id":"2208.05950","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.05950","snapshot_observed_at":"2026-07-11T00:57:42.200140Z","title":"Microsoft","venue":"cs.SE","work_id":"bce08310-4b88-4a92-83ed-805f724c2228","year":2022},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"cited_paper":"/paper/2208.05950","citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:a116a56b6e76eecf8fc42d7c9542335afc63ee7870399b1e609aad50e80df777","observation_id":"c6a1faa0-07e3-4cef-a5a1-8a6c36dcc17c","resolution":{"observed_at":"2026-07-11T00:57:42.220834Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.534935Z","title":"Automated program repair","venue":null,"work_id":"fa963b8c-a3e6-4574-b488-24412d544d93","year":2019},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:cce6236318012b8d67a7912b77ff06982489301fa87bb3eb65bfe39fdb3d76e7","observation_id":"2a9b4abe-73fb-48cb-a49b-66ffcca98aa0","resolution":{"observed_at":"2026-07-11T00:57:44.553040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.765405Z","title":"Rustan M","venue":null,"work_id":"81a33bb6-e13b-4ae0-bdc4-644372ca569c","year":2010},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:c5ca0dea1c72b815b6da6416f3a29d8d2bab0d5ba158b1622f9590c467f3c50c","observation_id":"f269747e-b7cb-4d24-beff-d11f6b30e62a","resolution":{"observed_at":"2026-07-11T00:57:44.784593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.615027Z","title":"Is your code generated by ChatGPT really correct? rigorous evaluation of large language models for code generation","venue":null,"work_id":"06ba96a3-09dd-4696-ba36-965d0db72422","year":2023},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:946de6775b3fcb4d4e23ff11e100031c2df70277d9d7d3e0f508fb105c324fa4","observation_id":"3139d840-7ad2-42c9-ad15-c3628af7a3b6","resolution":{"observed_at":"2026-07-11T00:57:44.634836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.701128Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":"edd324d4-f800-4ff1-b51c-9a3b4fb834ca","year":2023},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:ded083a8b6e3e1e745790bfd9a85772398f8cea8c4b95663daa1b5cb85d1faca","observation_id":"6eed79ab-7505-46bd-b8ab-837fab07b990","resolution":{"observed_at":"2026-07-11T00:57:44.720664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.786971Z","title":"Applying ``design by contract''","venue":null,"work_id":"eae27558-ce6e-4847-8414-bcce30a02a34","year":1992},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:aaf09b52d61f1f76d58e946da181e987c8ba8a0ec8f82935e72d33fe9e0f4ffe","observation_id":"2ec58a2c-4985-4b4e-b380-d6db75aa6e2d","resolution":{"observed_at":"2026-07-11T00:57:44.804671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.576267Z","title":"Wang, and Xi Victoria Lin","venue":null,"work_id":"82bf4ed0-5648-4ef6-9aab-d4ed4367a567","year":2023},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:7474d818e0c8ee64fd840133e046c4958daab449b1ece171554a0923e8bbfb1b","observation_id":"e853258a-e462-4993-a42f-33d620cb5a45","resolution":{"observed_at":"2026-07-11T00:57:44.592151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-08-16T00:13:58.777607Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":"2605.18747","doi":"10.48550/arxiv.2605.18747","metadata_source":"pith","pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Code as Agent Harness","venue":"cs.CL","work_id":"37bdf317-af61-48e1-9225-d6e14b264a37","year":2026},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:8b573e00297f95e2bcda04d7739aa488b03429ac19978bc145a633b63288daf2","observation_id":"4feb195b-af34-4dce-86cf-ab60336b8493","resolution":{"observed_at":"2026-07-11T00:57:42.254847Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.507472Z","title":"Olausson, Jeevana Priya Inala, Chenglong Wang, Jianfeng Gao, and Armando Solar-Lezama","venue":null,"work_id":"34fea939-36f6-43e1-9f29-6e5f0a680c6a","year":2024},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:946445c00d8147f9eac658e4d5cdc253e5607813210a28b22bd37f6673c28fb4","observation_id":"81295b76-5c62-4e3f-b36f-b14811dfe54e","resolution":{"observed_at":"2026-07-11T00:57:44.526191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08500","last_updated":"2024-01-16T17:00:36Z","snapshot_observed_at":"2026-08-17T15:38:45.204670Z","submitted_at":"2024-01-16T17:00:36Z","title":"Code Generation with AlphaCodium: From Prompt Engineering to Flow Engineering","version":1},"cited_work":{"arxiv_id":"2401.08500","doi":"10.48550/arxiv.2401.08500","metadata_source":"pith","pith_arxiv_id":"2401.08500","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Code generation with AlphaCodium : From prompt engineering to flow engineering","venue":"cs.LG","work_id":"2410b7d6-1430-418e-be26-a13142081620","year":2024},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"cited_paper":"/paper/2401.08500","citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:7243d58dfe2df3ad75be98fc7cc5182ed583ffd29ee41cd4c43d4a9157e68241","observation_id":"6b10baaa-6987-44a3-8794-10622ec23b9a","resolution":{"observed_at":"2026-07-11T00:57:42.166859Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:19:50.213914+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:19:50.213914+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-18T03:59:39.242039Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":"2308.12950","doi":"10.48550/arxiv.2308.12950","metadata_source":"pith","pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Code Llama: Open Foundation Models for Code","venue":"cs.CL","work_id":"e73bffa4-7620-47ac-9327-259a60db52ca","year":2023},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:ec0d3836b1e6da689c7cba6fb658359794504e5398ec32abb9f4f15549f5381a","observation_id":"c8778059-64eb-4452-a5a7-bd69056e1f59","resolution":{"observed_at":"2026-07-11T00:57:42.187173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:36.742994+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:36.742994+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.637644Z","title":"Reflexion: Language agents with verbal reinforcement learning","venue":null,"work_id":"e0a7f10a-6177-432b-af7e-418dbb4590ee","year":2023},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:3780ba6900719f1db943618a1482c192fd3616a5ffb3e680d93ef98596207e48","observation_id":"68c6b764-5532-43f4-beb9-f94e534058ed","resolution":{"observed_at":"2026-07-11T00:57:44.656740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.744503Z","title":"Jimenez, Alexander Wettig, Kilian Lieret, Shunyu Yao, Karthik Narasimhan, and Ofir Press","venue":null,"work_id":"dfec883e-1439-4e81-b255-677444496cde","year":2024},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:3cb409fdb7d1e8af815bb92ccb34ba753456f61cd65293ce77e8dd5eec0f1093","observation_id":"d029648e-9111-4ca8-9ccf-0cac2dc62982","resolution":{"observed_at":"2026-07-11T00:57:44.762741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.765555Z","title":"Judging LLM -as-a-judge with MT -bench and chatbot arena","venue":null,"work_id":"1793d080-eae3-4ec6-ae94-3cf6886bdef2","year":2023},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:ae33500eedb0444e5d41f4d2299a778275bea6dade35d62ac568cf2d089ce5fe","observation_id":"420a1065-235d-4494-83c1-cabb7bf434e4","resolution":{"observed_at":"2026-07-11T00:57:44.784278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-15T01:44:42.805776Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":5,"verified_fuzzy":17},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2607.06636."}