{"as_of":"2026-08-05T06:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:704e7c1fe914c8d9da63cb0731cffa90f1148e27a2b0652f4367a4a318d53c9c","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T07:05:57.220730Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.28049/citation-record","integrity":"/paper/2604.28049/integrity","json":"/paper/2604.28049/citation-record.json","paper":"/paper/2604.28049"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spider: A Large-Scale Human-Labeled Dataset for Complex and Cross-Domain Semantic Parsing and Text-to-SQL Task","venue":null,"work_id":"48086a47-2930-4a24-a3ae-69aa45b3a191","year":2018},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:d0a6e9e362542e74c637c43fcbfd7ac42db6d24b8f42a1ccc77aedca3a523f84","observation_id":"1cd96126-d428-44d1-a3cd-7faaeb2cda40","resolution":{"observed_at":"2026-05-27T09:43:55.294678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c141c4c4-7c2d-4e89-becb-f4d2deeef12a","year":null},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:92f770748441d2a9f7b61903b10620f87f3774aeda75a8734c55858319416fe0","observation_id":"20877514-92cd-477a-8e27-cef38c724075","resolution":{"observed_at":"2026-05-27T09:43:55.298986Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A Big Bench for Large-Scale Database Grounded Text-to-SQLs BIRD","venue":null,"work_id":"99e2bbb9-3e1b-4f04-8dc4-55cc4a756776","year":null},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:0cd8ff2caeec293a194459b54e688f05b861512aa663bb7a475b7cb1e873797e","observation_id":"557662ba-51b1-4d45-b30f-188509eac7fc","resolution":{"observed_at":"2026-05-27T09:43:55.286384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FeTaQA: Free-form Table Question Answering.TACL","venue":null,"work_id":"7a38d9d9-09ae-42c4-8370-154714b821c7","year":2022},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:bc83eaf175800afa502801b5155208b77aca11a27fba8053008b5aa98a10b4bd","observation_id":"7a325656-f81e-4724-b2e4-eb116cf3d238","resolution":{"observed_at":"2026-05-27T09:43:55.314619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02840","last_updated":"2020-10-06T16:04:12Z","snapshot_observed_at":"2026-07-06T10:01:59.328372Z","submitted_at":"2020-10-06T16:04:12Z","title":"Semantic Evaluation for Text-to-SQL with Distilled Test Suites","version":1},"cited_work":{"arxiv_id":"2010.02840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.02840","snapshot_observed_at":"2026-07-01T23:36:23.400574Z","title":"Victor Zhong, Caiming Xiong, and Richard Socher","venue":null,"work_id":"438c67fc-900b-450d-8810-e6bc2b084e5a","year":2010},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"cited_paper":"/paper/2010.02840","citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:d667ad929892dba06e5b89bd989c4752b863dd86be014741f4087489cd70e6fa","observation_id":"62c603fc-85b5-4331-98a0-03e4ed44d688","resolution":{"observed_at":"2026-05-12T10:11:28.706079Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cortex Analyst: Production Text-to-SQL Evaluation","venue":null,"work_id":"1bb78187-41c2-4a07-931e-e64189407893","year":2024},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:33b6e214d7306fc0f1992df9eccdb7d1a0f994feb441a2b0a6f36aa6b1f95db2","observation_id":"39540dbb-e7d1-41a0-9d77-0517a2f151ab","resolution":{"observed_at":"2026-05-27T09:43:55.290436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Production SQL Evaluation Framework","venue":null,"work_id":"3181a312-c737-4056-84ff-ac37f7c0a3b0","year":2025},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:4ea62e9f61733806cf11d98cef3236c2693cafab610d7360599dfc4f900c6308","observation_id":"0996c050-5683-4cbe-ae69-45d9073c01a0","resolution":{"observed_at":"2026-05-27T09:43:55.302960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":"2306.05685","doi":"10.1109/4235.797969","metadata_source":"pith","pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","venue":"cs.CL","work_id":"d0c30cd7-81e1-4159-a87f-f6adca77ff08","year":2023},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:3d928cee86a52ebe5ea5edf24ac7fa765585e17e0d472e431e95b1677223547b","observation_id":"9cd1bd5d-26a0-4f85-855b-3f32937eb5cd","resolution":{"observed_at":"2026-05-12T10:11:28.684839Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cortex Analyst: Evaluating text-to-SQL accuracy for real- world BI","venue":null,"work_id":"8c617a90-0741-47c4-a707-3096e0d3e1cd","year":2024},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:681e656db213ffe64d9bdcb85234bbf56c20f1452ad41f6d1e03c59100adb02e","observation_id":"edc79d4a-3554-4f35-9bf1-b448fc0e914a","resolution":{"observed_at":"2026-05-27T09:43:55.307157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19014","last_updated":"2024-10-28T11:11:04Z","snapshot_observed_at":"2026-07-31T13:27:05.357603Z","submitted_at":"2024-09-24T01:40:50Z","title":"FLEX: Expert-level False-Less EXecution Metric for Reliable Text-to-SQL Benchmark","version":4},"cited_work":{"arxiv_id":"2409.19014","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.19014","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"84b4a9eb-21f5-457d-8edb-c42d957f1bae","year":2024},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"cited_paper":"/paper/2409.19014","citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:29fed38df388901868eadd6bbe0aa33c9953be993334d3dfd2ed5c7074269c05","observation_id":"d728d771-d245-4618-9dd6-4afa0914fe41","resolution":{"observed_at":"2026-05-12T10:11:28.713740Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.08205","last_updated":"2019-05-29T02:50:00Z","snapshot_observed_at":"2026-07-06T07:54:13.561981Z","submitted_at":"2019-05-20T16:44:00Z","title":"Towards Complex Text-to-SQL in Cross-Domain Database with Intermediate Representation","version":2},"cited_work":{"arxiv_id":"1905.08205","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.08205","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards Complex Text-to-SQL in Cross-Domain Database with Intermediate Representation","venue":"cs.CL","work_id":"93bb3f20-0bb3-42ec-8b6e-d3682449e2c1","year":2019},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"cited_paper":"/paper/1905.08205","citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:b60268b8718d80a3c4b20c7edf74f2ecdb7a6b32467cffce6642323d484f8962","observation_id":"f748ba2e-674c-4e8a-a1f4-000cbd47f000","resolution":{"observed_at":"2026-05-12T10:11:28.697588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.04942","last_updated":"2021-08-24T05:29:12Z","snapshot_observed_at":"2026-07-06T08:36:24.990567Z","submitted_at":"2019-11-10T09:09:13Z","title":"RAT-SQL: Relation-Aware Schema Encoding and Linking for Text-to-SQL Parsers","version":5},"cited_work":{"arxiv_id":"1911.04942","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1911.04942","snapshot_observed_at":"2026-07-02T07:56:47.072283Z","title":"arXiv preprint arXiv:1911.04942 , year=","venue":null,"work_id":"03fb9299-0186-4100-a96d-36c13ca3cab3","year":2021},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"cited_paper":"/paper/1911.04942","citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:bab43c94f65e152d40c0804fc4f2affeaf31220f1b7464c4f6f640fe6eefda48","observation_id":"c85a7ea0-8267-4d18-bd9f-26de31e93131","resolution":{"observed_at":"2026-05-12T10:11:28.710123Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02285","last_updated":"2019-06-05T20:05:18Z","snapshot_observed_at":"2026-08-04T02:11:00.062669Z","submitted_at":"2019-06-05T20:05:18Z","title":"SParC: Cross-Domain Semantic Parsing in Context","version":1},"cited_work":{"arxiv_id":"1906.02285","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.02285","snapshot_observed_at":"2026-07-02T07:56:47.097425Z","title":"SParC: Cross-Domain Semantic Parsing in Context","venue":"cs.CL","work_id":"3538fba7-4a5f-48a6-b379-57bdb384d4bc","year":2019},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"cited_paper":"/paper/1906.02285","citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:2c23069b33a5a967374abda9c6c171c8bc566b3ebc375af76edcf79608b83af8","observation_id":"6f800ae1-491e-4b3d-b652-1576cc15a9d2","resolution":{"observed_at":"2026-05-12T10:11:28.701822Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05378","last_updated":"2019-09-11T21:15:47Z","snapshot_observed_at":"2026-07-06T08:21:04.977267Z","submitted_at":"2019-09-11T21:15:47Z","title":"CoSQL: A Conversational Text-to-SQL Challenge Towards Cross-Domain Natural Language Interfaces to Databases","version":1},"cited_work":{"arxiv_id":"1909.05378","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1909.05378","snapshot_observed_at":"2026-07-02T07:56:47.082936Z","title":null,"venue":null,"work_id":"8f24f007-063b-4918-b5fb-3adcef664948","year":2019},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"cited_paper":"/paper/1909.05378","citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:b1a25c4f56d7263866a78921f436b42b2c1e628d7dd8f5c4bbd4cc783b094f7f","observation_id":"4deb8966-0520-4c1a-802f-444ec335bf9f","resolution":{"observed_at":"2026-05-12T10:11:28.688987Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01937","last_updated":"2023-05-03T07:28:50Z","snapshot_observed_at":"2026-08-02T17:07:32.299595Z","submitted_at":"2023-05-03T07:28:50Z","title":"Can Large Language Models Be an Alternative to Human Evaluations?","version":1},"cited_work":{"arxiv_id":"2305.01937","doi":"10.48550/arxiv.2305.01937","metadata_source":"pith","pith_arxiv_id":"2305.01937","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Can large language models be an alternative to human evaluations?","venue":"cs.CL","work_id":"0fb62126-21b0-4011-8072-2f3c760d9669","year":2023},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"cited_paper":"/paper/2305.01937","citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:38b993c70582a8615d4c1ea59831fed76040f237ed5447e6021cbc8f40554039","observation_id":"1852c7c6-a82c-4588-971c-8b94274622cf","resolution":{"observed_at":"2026-05-12T10:11:28.693906Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Elgohary, D","venue":null,"work_id":"0724f7c1-a7d7-45ef-a5f2-89042bcaa29e","year":2019},"citing_paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-07T07:05:57.220730Z"},"links":{"citing_paper":"/paper/2604.28049"},"observation_digest":"sha256:b84c0e7c93998965cbd9b3205ebb6c8477b6aa4c22c86cf22638f3d0d7758aaa","observation_id":"b001dc32-f8b7-4314-96e5-441f18e09b9a","resolution":{"observed_at":"2026-05-27T09:43:55.310833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.28049","last_updated":"2026-04-30T15:59:28Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:13:24.960159Z","submitted_at":"2026-04-30T15:59:28Z","title":"Agent-Agnostic Evaluation of SQL Accuracy in Production Text-to-SQL Systems"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":0,"verified_exact":8,"verified_fuzzy":7},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2604.28049."}