{"as_of":"2026-08-08T06:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:54558657334370b18e4b5fde585b80224b630ab99d3502aca139b3fd3bb27a44","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:07:50.196341Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T13:23:27.706067Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code","version":4},"cited_work":{"arxiv_id":"2402.02047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02047","snapshot_observed_at":"2026-06-29T13:23:27.706067Z","title":"arXiv preprint arXiv:2402.02047 (2024)","venue":null,"work_id":"685cbfda-ea1c-4db1-9243-d2e60ced0c1f","year":2024},"citing_paper":{"arxiv_id":"2410.20791","last_updated":"2026-04-06T19:29:25Z","snapshot_observed_at":"2026-08-03T01:41:19.546733Z","submitted_at":"2024-10-28T07:16:00Z","title":"From Cool Demos to Production-Ready FMware: Core Challenges and a Technology Roadmap","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-23T19:07:21.016824Z"},"links":{"cited_paper":"/paper/2402.02047","citing_paper":"/paper/2410.20791"},"observation_digest":"sha256:d389d2dd44571ba4692f510932edd9825c64f67a3cf5855632b074e1cb57cdcf","observation_id":"9458fe60-c486-49fc-b3a6-071c6512f2fa","resolution":{"observed_at":"2026-05-23T19:08:20.930402Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code","version":4},"cited_work":{"arxiv_id":"2402.02047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02047","snapshot_observed_at":"2026-06-29T13:23:27.706067Z","title":"arXiv preprint arXiv:2402.02047 (2024)","venue":null,"work_id":"685cbfda-ea1c-4db1-9243-d2e60ced0c1f","year":2024},"citing_paper":{"arxiv_id":"2411.10656","last_updated":"2026-04-03T16:24:12Z","snapshot_observed_at":"2026-07-06T19:51:14.080262Z","submitted_at":"2024-11-16T01:31:29Z","title":"Precision or Peril: A PoC of Python Code Quality from Quantized Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-23T17:30:54.204300Z"},"links":{"cited_paper":"/paper/2402.02047","citing_paper":"/paper/2411.10656"},"observation_digest":"sha256:fd82bb3edc6722e87f35380f9972decace635c314c803c16fdd1f7cec8908f19","observation_id":"91bc21d5-70dd-44ca-84c2-54c45129581b","resolution":{"observed_at":"2026-05-23T17:33:15.817779Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02047","snapshot_observed_at":"2026-08-07T13:07:50.196341Z","title":"Calibration and correctness of language models for code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22660","last_updated":"2025-06-27T17:25:28Z","snapshot_observed_at":"2026-08-07T12:59:59.342982Z","submitted_at":"2025-05-28T17:59:37Z","title":"Maximizing Confidence Alone Improves Reasoning","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:07:50.196341Z"},"links":{"cited_paper":"/paper/2402.02047","citing_paper":"/paper/2505.22660"},"observation_digest":"sha256:cab7ccdae04a75ba3b74f13cdb50b230a2b6b41c81f9dd3be8e16d385d6280f4","observation_id":"d6335b55-a209-4ab6-b61e-d45eb2a16e93","resolution":{"observed_at":"2026-08-07T13:07:50.196341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02047","snapshot_observed_at":"2026-08-07T11:54:57.245537Z","title":"Calibration and correctness of language models for code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04255","last_updated":"2025-06-01T17:33:16Z","snapshot_observed_at":"2026-08-07T11:48:25.394575Z","submitted_at":"2025-06-01T17:33:16Z","title":"HASHIRU: Hierarchical Agent System for Hybrid Intelligent Resource Utilization","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:57.245537Z"},"links":{"cited_paper":"/paper/2402.02047","citing_paper":"/paper/2506.04255"},"observation_digest":"sha256:6d43d0223cac9be1e82d4944513f49bbaadae73bcd1b8e13480316b955aaf14e","observation_id":"3b788c2e-7345-4ba5-9535-a00bdc02dd74","resolution":{"observed_at":"2026-08-07T11:54:57.245537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02047","snapshot_observed_at":"2026-08-07T10:46:27.137079Z","title":"Calibration and correctness of language models for code, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04494","last_updated":"2025-06-04T22:25:47Z","snapshot_observed_at":"2026-08-07T22:59:09.506106Z","submitted_at":"2025-06-04T22:25:47Z","title":"SQLens: An End-to-End Framework for Error Detection and Correction in Text-to-SQL","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:27.137079Z"},"links":{"cited_paper":"/paper/2402.02047","citing_paper":"/paper/2506.04494"},"observation_digest":"sha256:151d264082c5a0a6be96dc069866f65275787483d8f2021d50b7d0a6c1ebefb2","observation_id":"0ac83f00-e400-42df-ac6d-d2ded0746aee","resolution":{"observed_at":"2026-08-07T10:46:27.137079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02047","snapshot_observed_at":"2026-08-06T18:57:13.102050Z","title":"Quality and trust in llm- generated code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06980","last_updated":"2025-07-09T16:07:20Z","snapshot_observed_at":"2026-08-06T18:47:42.677323Z","submitted_at":"2025-07-09T16:07:20Z","title":"Are They All Good? Evaluating the Quality of CoTs in LLM-based Code Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:57:13.102050Z"},"links":{"cited_paper":"/paper/2402.02047","citing_paper":"/paper/2507.06980"},"observation_digest":"sha256:8231f7dcb8b86b4680f8d3f637adb94a37c5749437ae28205258a227ab396972","observation_id":"74954589-49b8-41f1-8aa4-c9aae5fc6359","resolution":{"observed_at":"2026-08-06T18:57:13.102050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02047","snapshot_observed_at":"2026-08-05T22:22:15.505584Z","title":"Calibration and correctness of language models for code,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07169","last_updated":"2025-08-10T04:04:15Z","snapshot_observed_at":"2026-08-05T22:22:13.739038Z","submitted_at":"2025-08-10T04:04:15Z","title":"From Noise to Knowledge: Interactive Summaries for Developer Alerts","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T22:22:15.505584Z"},"links":{"cited_paper":"/paper/2402.02047","citing_paper":"/paper/2508.07169"},"observation_digest":"sha256:04886cbbc1d0217acee7e1be79553cc075b41880ecce3cdbeba761eff7704c76","observation_id":"433b2156-d3f4-4802-bf9a-d7ec79fb0192","resolution":{"observed_at":"2026-08-05T22:22:15.505584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02047","snapshot_observed_at":"2026-08-05T10:22:31.442315Z","title":"https://doi.org/10.48550/ARXIV.2402.02047","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04198","last_updated":"2025-09-04T13:22:44Z","snapshot_observed_at":"2026-08-05T10:22:30.669431Z","submitted_at":"2025-09-04T13:22:44Z","title":"Are LLM Agents the New RPA? A Comparative Study with RPA Across Enterprise Workflows","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:22:31.442315Z"},"links":{"cited_paper":"/paper/2402.02047","citing_paper":"/paper/2509.04198"},"observation_digest":"sha256:d58eca2e1706b439328043c363a7621eaf018070ba1dc6b9880f1806f8e37a1a","observation_id":"3a0f64a5-1db7-4819-80bd-e76c0aeef5be","resolution":{"observed_at":"2026-08-05T10:22:31.442315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02047","snapshot_observed_at":"2026-08-03T11:01:24.795273Z","title":"Calibration and correctness of lan- guage models for code.arXiv preprint arXiv:2402.02047,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.07965","last_updated":"2026-06-28T07:55:15Z","snapshot_observed_at":"2026-08-06T12:01:54.231929Z","submitted_at":"2026-01-12T19:59:03Z","title":"When Models Know When They Do Not Know: Calibration, Cascading, and Cleaning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T11:01:24.795273Z"},"links":{"cited_paper":"/paper/2402.02047","citing_paper":"/paper/2601.07965"},"observation_digest":"sha256:5699967d8d68639980e2ad174b18d37dcfd3e3718fec9e13544d84642075d0b3","observation_id":"f8d6a8c1-7b9d-4d22-b4cd-4d5728ccf61e","resolution":{"observed_at":"2026-08-03T11:01:24.795273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02047","snapshot_observed_at":"2026-08-03T00:05:10.800151Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.11719","last_updated":"2026-06-10T14:31:47Z","snapshot_observed_at":"2026-08-07T16:10:58.182295Z","submitted_at":"2026-02-12T08:48:51Z","title":"Uncertainty-aware Generative Recommendation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T00:05:10.800151Z"},"links":{"cited_paper":"/paper/2402.02047","citing_paper":"/paper/2602.11719"},"observation_digest":"sha256:2c49bbda217f914775be0c97867e77165e4f05d3727ea77b627750c2bec93b7a","observation_id":"b676da9b-7f28-41d6-af13-c2881c99fec2","resolution":{"observed_at":"2026-08-03T00:05:10.800151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code","version":4},"cited_work":{"arxiv_id":"2402.02047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02047","snapshot_observed_at":"2026-06-29T13:23:27.706067Z","title":"arXiv preprint arXiv:2402.02047 (2024)","venue":null,"work_id":"685cbfda-ea1c-4db1-9243-d2e60ced0c1f","year":2024},"citing_paper":{"arxiv_id":"2605.19369","last_updated":"2026-05-19T05:04:42Z","snapshot_observed_at":"2026-08-06T21:29:48.458204Z","submitted_at":"2026-05-19T05:04:42Z","title":"When to Answer and When to Defer: A Decision Framework for Reliable Code Predictions","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T04:53:51.761561Z"},"links":{"cited_paper":"/paper/2402.02047","citing_paper":"/paper/2605.19369"},"observation_digest":"sha256:063ce8f1be78b2c4c5492ae9074896129fac7bce554729ecb23adc6bb279f580","observation_id":"797d6605-8ed0-40f0-8e55-545c27118169","resolution":{"observed_at":"2026-05-20T04:58:05.246101Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code","version":4},"cited_work":{"arxiv_id":"2402.02047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02047","snapshot_observed_at":"2026-06-29T13:23:27.706067Z","title":"arXiv preprint arXiv:2402.02047 (2024)","venue":null,"work_id":"685cbfda-ea1c-4db1-9243-d2e60ced0c1f","year":2024},"citing_paper":{"arxiv_id":"2605.28500","last_updated":"2026-05-27T14:01:30Z","snapshot_observed_at":"2026-08-03T16:15:08.120077Z","submitted_at":"2026-05-27T14:01:30Z","title":"Functional Entropy: Predicting Functional Correctness in LLM-Generated Code with Uncertainty Quantification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T13:23:01.482449Z"},"links":{"cited_paper":"/paper/2402.02047","citing_paper":"/paper/2605.28500"},"observation_digest":"sha256:fbecadf94a3399a2817f46523abb7dad3df81f1584e71a13d7ec65a9fdd4a6cb","observation_id":"21630938-1ef1-4a55-b707-a43089dd6d27","resolution":{"observed_at":"2026-06-29T13:23:27.712897Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.02047/citation-record","integrity":"/paper/2402.02047/integrity","json":"/paper/2402.02047/citation-record.json","paper":"/paper/2402.02047"},"outbound":[],"paper":{"arxiv_id":"2402.02047","last_updated":"2024-08-21T01:58:38Z","latest_version":4,"primary_category":"cs.SE","snapshot_observed_at":"2026-07-06T17:24:45.062473Z","submitted_at":"2024-02-03T05:52:28Z","title":"Calibration and Correctness of Language Models for Code"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2402.02047."}