{"as_of":"2026-08-15T22:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:55be230a5ebe4c80e39deecf1dc6da9993e54d17492a1069c2ff0ae1f0633804","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T21:05:58.726650Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:45:27.663753Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T00:45:28.010845Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"cited_work":{"arxiv_id":"2607.06799","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.06799","snapshot_observed_at":"2026-08-12T00:45:28.010845Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","venue":"cs.LG","work_id":"ba578b63-9ab9-41b2-b62c-4c8dad066a4a","year":2026},"citing_paper":{"arxiv_id":"2608.07946","last_updated":"2026-08-08T06:12:18Z","snapshot_observed_at":"2026-08-15T10:03:17.392032Z","submitted_at":"2026-08-08T06:12:18Z","title":"Metadata Reconstruction from Values Alone: Recovering Column Semantics in Undocumented Warehouses","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T00:45:27.663753Z"},"links":{"cited_paper":"/paper/2607.06799","citing_paper":"/paper/2608.07946"},"observation_digest":"sha256:25a054c01530c4a8fec3436f71cdcbd0c6f516197c0dc55bf6c7e682d9cabeac","observation_id":"73dbfb92-00cc-4752-8a05-289370d8e23d","resolution":{"observed_at":"2026-08-12T00:45:28.018638Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.06799/citation-record","integrity":"/paper/2607.06799/integrity","json":"/paper/2607.06799/citation-record.json","paper":"/paper/2607.06799"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.723850Z","title":"EMNLP , year=","venue":null,"work_id":"ca4d6fab-1a88-4098-b7a8-fbc351db03a8","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:d1bfc181b08f8cc8feb2102b54ec9ee562847939dd5cfd8b1909db4b82c37796","observation_id":"6d4ecda7-fb26-4498-80d5-b065ce89f5eb","resolution":{"observed_at":"2026-07-10T21:07:37.736419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.769151Z","title":"ICLR , year=","venue":null,"work_id":"fa054005-7f09-4758-bb44-e2aa7c173125","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:ba34819d24b84f34d3a1364ed6659ababd0067604a24ce5917808db650ae94ad","observation_id":"2aa8957d-0eaf-4359-be46-828a24e23cc0","resolution":{"observed_at":"2026-07-10T21:07:37.781922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.694069Z","title":"NeurIPS Datasets and Benchmarks , year=","venue":null,"work_id":"f56fa845-b874-455b-a01a-4e0b4761e8ba","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:7e880b923029529b739fc5d7e08ab5cca238d82b7311b714e5a6bea8154f62e6","observation_id":"6676c33c-9284-48d9-a184-3d9972f0107a","resolution":{"observed_at":"2026-07-10T21:07:37.706786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.649818Z","title":"ACL , year=","venue":null,"work_id":"6eeb253f-da25-4323-a663-a497fcfdb058","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:a085455de9275652d57036aa3cb9746d01e65e510771aa574a77c9d10a88a36b","observation_id":"598fbf43-9367-4f3c-b746-60a4e762173e","resolution":{"observed_at":"2026-07-10T21:07:37.661821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.880276Z","title":"ACL , year=","venue":null,"work_id":"314ee835-702e-44d1-858e-e04e9c258b10","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:868a518a93cfba1b6616fa46cbe6fbd54871e2673c545bad4de399020a0e7be1","observation_id":"84b6777a-c917-40e6-8bcf-198addfef92b","resolution":{"observed_at":"2026-07-10T21:07:37.893120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.895048Z","title":"ICLR , year=","venue":null,"work_id":"bba1d259-6b31-4d6e-a6e8-3d594b7f9d5e","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:95c067c1aa910cf6f3d757a84634302b457093aab4fd06e88153a8007803e9f7","observation_id":"a022c357-680f-41a9-9c98-2e4dc3f4e944","resolution":{"observed_at":"2026-07-10T21:07:37.907871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.678808Z","title":"ICLR , year=","venue":null,"work_id":"71dcb20d-2fc7-478e-b3c1-177eb5cacde0","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:3948e1b70228edb9517f5e4b5fa7f930738550af13b32ad95205246a80f116b0","observation_id":"85d0f5eb-a899-403d-a43b-ad1b9cbee3fc","resolution":{"observed_at":"2026-07-10T21:07:37.692181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.604266Z","title":"Nature , volume=","venue":null,"work_id":"ac469dc3-45fc-405b-9b9a-1adfa04093a3","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:2b2b60348ba7b7b6f00f5fd0f01c0a869d71c2a3499669a0916c3aba88ffd650","observation_id":"3d3a000a-3076-4e75-aec2-36c919f22c50","resolution":{"observed_at":"2026-07-10T21:07:37.617283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.851245Z","title":"The Annals of Probability , volume=","venue":null,"work_id":"c6fcf852-7ccc-4895-b5f1-f483b1986c04","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:42f448892c0072d112c688285c179aa9609d83778b19721a197683e2c5458e65","observation_id":"be941299-7aa0-4050-a0c9-125283c25d3c","resolution":{"observed_at":"2026-07-10T21:07:37.863831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.399387Z","title":"ACL , year=","venue":null,"work_id":"525595c2-4301-4144-be8c-07b65c792ed7","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:83297f92457b1ccc3f729caafa3c5e14f8970a10bad11c13726d302f86c7cc14","observation_id":"6da6d63b-18f6-421d-9333-9a8981ee5d92","resolution":{"observed_at":"2026-07-10T21:07:37.412994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.574084Z","title":"Advances in Neural Information Processing Systems (NIPS) , pages=","venue":null,"work_id":"1796758c-1c51-40e2-8344-8701862f2f0a","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:b31ffde1fb4b92f9ca89e87305fca3870018a9e9bd14c9ecf0f02801d05b7dde","observation_id":"3b6b829c-2a40-4785-9fc4-2e4a16e05ed9","resolution":{"observed_at":"2026-07-10T21:07:37.586916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.619250Z","title":"Biometrika , volume=","venue":null,"work_id":"42336c0c-29e8-455b-bc9a-c1fa76c96591","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:a716ff25d4cb4236f62802940010c6ac419362c8b9b44fcc3964e9b2f614e8d3","observation_id":"911c9c56-dd45-44b6-ace3-03470bdaf6e1","resolution":{"observed_at":"2026-07-10T21:07:37.632349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.835925Z","title":"ICML , year=","venue":null,"work_id":"229c4b0c-0e69-4475-b89c-e0ca25d2fe03","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:dc9af527e82d1ef619827f9db1165f158baf8f5f1f9c1face85e7c08ac95f649","observation_id":"336e1a63-b790-44f1-977c-116800027157","resolution":{"observed_at":"2026-07-10T21:07:37.849263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.865632Z","title":"NeurIPS , year=","venue":null,"work_id":"8225fdb4-a225-42ba-84d7-b3f775ffffee","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:966335ea98257f59a5cce632f9413b4f32901232a95b3532fddfce54374d6187","observation_id":"8fff7f0d-a1c0-47ac-8c17-1cee320ff8dc","resolution":{"observed_at":"2026-07-10T21:07:37.878394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.909874Z","title":"Proceedings of the ACM on Management of Data (SIGMOD) , year=","venue":null,"work_id":"aadeec81-af3c-478e-b355-0d8f308e22b1","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:0a27c5b528a8a9dd8292472d57a4c0bc60bbdc4ba3145b166140f8cda078924c","observation_id":"d2ccc553-d7fa-45f9-9d26-2e598c58d4b5","resolution":{"observed_at":"2026-07-10T21:07:37.922835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.924652Z","title":"arXiv preprint , year=","venue":null,"work_id":"8e5d8b54-6272-42c9-88e4-3617b425ff63","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:686f35fcb557cee3e26a49bc079576f69f40ce750c70856506dd1e7d748a3869","observation_id":"18e509b4-f4f7-455c-9b5e-a03cf102455d","resolution":{"observed_at":"2026-07-10T21:07:37.937275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.939153Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year=","venue":null,"work_id":"ae7b4e13-4698-4a50-b585-8bbdef9c720c","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:642e8ec45651a86b774fbe1f6a7bcd996198b8ab054aa04396abc1092e4f311f","observation_id":"05cbdf6c-e697-4aef-a132-b90945f6f7db","resolution":{"observed_at":"2026-07-10T21:07:37.952220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.821219Z","title":"International Conference on Learning Representations (ICLR) , year=","venue":null,"work_id":"cf7b2d58-2d2c-4064-aa3c-6c4d6eb4b12a","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:61e79311ac04f26a6ecb1af2bdf0094556e64fa3f9c6b7ad9613d8ebcd40e726","observation_id":"d6935473-6a7a-409a-b471-8c9116ab8183","resolution":{"observed_at":"2026-07-10T21:07:37.834053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.777385Z","title":null,"venue":null,"work_id":"444653d4-57f2-4007-8d09-35d41dd15ca2","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:cc242ffd85b8cd389aec3b810711366d3dd4df3737a30b24b1221a42a02d62f5","observation_id":"aeb81944-9997-43bc-9f31-4b803188d15b","resolution":{"observed_at":"2026-07-10T21:07:37.789885Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.747460Z","title":null,"venue":null,"work_id":"44dfcac1-2b96-42b6-b6e2-67a455c1c2ba","year":null},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:aaa0d3a920a1055524ce968d8bb3659a0999901b58428513eef17fe4b96c2931","observation_id":"ab086981-df36-45fa-a94f-41c7b7b4b32b","resolution":{"observed_at":"2026-07-10T21:07:37.759585Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.01052","last_updated":"2022-09-29T23:51:57Z","snapshot_observed_at":"2026-08-13T18:00:12.880008Z","submitted_at":"2021-10-03T17:42:03Z","title":"Learn then Test: Calibrating Predictive Algorithms to Achieve Risk Control","version":5},"cited_work":{"arxiv_id":"2110.01052","doi":"10.48550/arxiv.2110.01052","metadata_source":"pith","pith_arxiv_id":"2110.01052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learn then test: Calibrating predictive algorithms to achieve risk control","venue":"cs.LG","work_id":"269a0cf9-f467-4af0-bd05-c8ced7ffc223","year":2021},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"cited_paper":"/paper/2110.01052","citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:c95488d0568cc7ad3ce17c706b26f01f99587a66931b6cb7150bb1d2176826a6","observation_id":"18f5ae80-c8d0-47bb-a4ba-68b4cbbe7714","resolution":{"observed_at":"2026-07-10T21:07:36.972681Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.02814","last_updated":"2025-06-13T18:38:23Z","snapshot_observed_at":"2026-08-13T14:50:29.157891Z","submitted_at":"2022-08-04T17:59:44Z","title":"Conformal Risk Control","version":4},"cited_work":{"arxiv_id":"2208.02814","doi":"10.48550/arxiv.2208.02814","metadata_source":"pith","pith_arxiv_id":"2208.02814","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Conformal risk control","venue":"stat.ME","work_id":"f128186a-0fb5-4d5e-bcef-0cedda44e79c","year":2022},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"cited_paper":"/paper/2208.02814","citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:8f2f6a3af9e981d473304ee9a6d6334c5f849e7ff6b1c03b3f4641a67fbd08bc","observation_id":"36508535-6302-4fc4-b376-30ab1acf6aaf","resolution":{"observed_at":"2026-07-10T21:07:36.990981Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:53:57.836962+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:53:57.836962+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.761401Z","title":"Lgesql: Line graph enhanced text-to-sql model with mixed local and non-local relations","venue":null,"work_id":"087a5245-7fdd-4913-b508-b60baa47136a","year":2021},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:f06078c91d9221558f84911561f9a11b89aa8da1d64001b4742438a1cde28824","observation_id":"d9592470-4b28-42ab-8737-0fb1a93b9bc5","resolution":{"observed_at":"2026-07-10T21:07:37.775465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.725748Z","title":"Teaching large language models to self-debug","venue":null,"work_id":"2cebe456-fbca-45e8-95e9-ef2cbc70d575","year":2024},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:a1d837444ecd19b34a27ff9f9a7865594d954443e34fa85a2b9d912a933261e2","observation_id":"83d1880e-8b40-405e-b030-6682d506684d","resolution":{"observed_at":"2026-07-10T21:07:37.745635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.716446Z","title":"Detecting hallucinations in large language models using semantic entropy","venue":null,"work_id":"972a399d-a864-4bc4-9329-a8b8bcf07995","year":2024},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:e709823e8b7c6867014b74a7e40e75cbd59dece16d15986b9274d696b145ee18","observation_id":"656f655d-ffa8-44b0-a169-291e4fc47590","resolution":{"observed_at":"2026-07-10T21:07:37.730051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.791871Z","title":"Selective classification for deep neural networks","venue":null,"work_id":"489fc31c-d64d-4355-84f6-9414516962ee","year":2017},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:670fcaae068ff2a672b38f349ceb02dfc63e6c5327fba8989f8b8af17efb1220","observation_id":"d39a871a-89d9-44f8-b44d-ee9bacf6d9df","resolution":{"observed_at":"2026-07-10T21:07:37.805095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.806913Z","title":"Weinberger","venue":null,"work_id":"c3843332-de1a-42e7-b2dd-65d78eeb146c","year":2017},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:fb5b4f29f7da6dc38c1e3cb30c5dd4309e26018a1a02f3df0f7d07a85262bfac","observation_id":"8ea3b387-f03d-4259-b442-511a2ee99962","resolution":{"observed_at":"2026-07-10T21:07:37.819446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.670518Z","title":"Semantic uncertainty: Linguistic invariances for uncertainty estimation in natural language generation","venue":null,"work_id":"8dcd425d-2018-4a63-a69b-dd1d96ad6106","year":2023},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:9a69539b370fc640316327f548a7c0512b82c96e2a9db198cb7fd8eed1286bc7","observation_id":"1445560d-f8cd-49fc-8c6d-924e13ecda8e","resolution":{"observed_at":"2026-07-10T21:07:37.684171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.701202Z","title":"Spider 2.0: Evaluating language models on real-world enterprise text-to-sql workflows","venue":null,"work_id":"48e80fb1-eae5-461c-aee7-3fe8ff4f3bfd","year":2025},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:4630ef2322969ec21d8350c9823b7683902db0c95fb6b8b01c69ea1e481e4181","observation_id":"dbae1a98-eb6b-49ba-a056-7a14d6d17b0c","resolution":{"observed_at":"2026-07-10T21:07:37.714549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.575737Z","title":"Can llm already serve as a database interface? a big bench for large-scale database grounded text-to-sqls (bird)","venue":null,"work_id":"5c92cbbf-16f7-432a-b075-f90f1cefa0d8","year":2023},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:af7c4a82972924c62be324e8e9faf397ed98345f7dc1b1af273f03849091ec86","observation_id":"e97dc660-5d01-4cbb-bba8-baa4f78330d0","resolution":{"observed_at":"2026-07-10T21:07:37.589141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.814383Z","title":"DIN-SQL : Decomposed in-context learning of text-to-sql with self-correction","venue":null,"work_id":"0d5a8d7a-201e-4db0-abb2-a4f958e22ac7","year":2023},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:9a198a9fc8061afb4f74f9379defacae4680e8e831c527e41b4374d9e18e7a34","observation_id":"d798cf48-7f2b-45fa-a9e8-f41354c992e7","resolution":{"observed_at":"2026-07-10T21:07:37.827197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.783798Z","title":"Calibrating large language models for text-to-sql","venue":null,"work_id":"6d8330fc-3380-48e1-a56b-d863de09c089","year":2024},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:5d430ceeb115538a3ff4b9383d28c1957a8e7ab1096c3a31df1458a2e2c0b2a5","observation_id":"601a238c-f68a-43cb-8834-9b2474ecb6d5","resolution":{"observed_at":"2026-07-10T21:07:37.797034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:57:44.637644Z","title":"Reflexion: Language agents with verbal reinforcement learning","venue":null,"work_id":"e0a7f10a-6177-432b-af7e-418dbb4590ee","year":2023},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:37d96255c98ecd58d0a022b5936169ae0659b1657e793da36712599a1ed8eea3","observation_id":"fdc72a16-81d1-4c0b-8757-58f67f455a9c","resolution":{"observed_at":"2026-07-10T21:07:37.556743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.622207Z","title":"Reliable text-to-sql with adaptive abstention","venue":null,"work_id":"6bd8defd-c01b-4ee8-9570-a8802a6bec38","year":2025},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:b3be9fd28ce421d8dea730a6bcd3d45770fed80754105c5a56302f3af77ec0cc","observation_id":"f873d3ac-b402-4373-9146-16a82c5d4034","resolution":{"observed_at":"2026-07-10T21:07:37.635565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.754141Z","title":"Rat-sql: Relation-aware schema encoding and linking for text-to-sql parsers","venue":null,"work_id":"07561b2a-57cb-420d-a87e-52dbbb8c5d3d","year":2020},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:c515aa89345347da46036a590f94645e35e337e586c2f73236323fbf7e6841f9","observation_id":"c587699c-475f-4055-bfda-0f3b514ccc01","resolution":{"observed_at":"2026-07-10T21:07:37.767307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.685988Z","title":"MAC-SQL : A multi-agent collaborative framework for text-to-sql","venue":null,"work_id":"f8b5ef51-d0a4-490e-abd2-648aaf96832d","year":2024},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:ed40e4d2b1603636eb7d6f41eb88bf396a86c842cc22f18cc66038990c96e5eb","observation_id":"04545aca-023c-4c57-9d7c-6b0fd6be865f","resolution":{"observed_at":"2026-07-10T21:07:37.699264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.591032Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":"a487133b-25e6-4943-91f0-d8b0a63b91bd","year":2023},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:98547f36eb77b7dae154828eaac901ffe6e7f054001c79c0b2509cc69a600b70","observation_id":"1120519e-482b-4898-ba5a-24e367b3ba9a","resolution":{"observed_at":"2026-07-10T21:07:37.604767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.606796Z","title":"Spider: A large-scale human-labeled dataset for complex and cross-domain semantic parsing and text-to-sql task","venue":null,"work_id":"2d4e9d89-24bb-4170-bbf7-888b53085a3e","year":2018},"citing_paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-10T21:05:58.726650Z"},"links":{"citing_paper":"/paper/2607.06799"},"observation_digest":"sha256:8f7fe03beba2b256f1838cf7c343e2cbff0324691bfd94761f1eac73163ba205","observation_id":"cadc180a-228a-4c5d-9d45-23f7ad5eed46","resolution":{"observed_at":"2026-07-10T21:07:37.620357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.06799","last_updated":"2026-07-07T20:52:58Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T12:45:51.395204Z","submitted_at":"2026-07-07T20:52:58Z","title":"What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":2,"verified_exact":0,"verified_fuzzy":34},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2607.06799."}