{"as_of":"2026-08-19T00:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8f1a0bd329282e3580fab6c0f5764540f14002a3052b5140667cd69df3d5ac9c","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T12:24:04.602809Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03794/citation-record","integrity":"/paper/2608.03794/integrity","json":"/paper/2608.03794/citation-record.json","paper":"/paper/2608.03794"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:04.479231Z","title":"arXiv preprint arXiv:2406.08426 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.479231Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:6adcb48420d44d1414690b09f71e918e8f69678416c7f5b7c2b566db9aa624b8","observation_id":"7dde2eec-4e90-4b56-95b6-4d89c034f60b","resolution":{"observed_at":"2026-08-05T12:24:04.479231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02643","last_updated":"2024-02-04T23:42:02Z","snapshot_observed_at":"2026-08-16T14:21:37.347966Z","submitted_at":"2024-02-04T23:42:02Z","title":"LLM-Enhanced Data Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02643","snapshot_observed_at":"2026-08-05T12:24:04.484917Z","title":"arXiv preprint arXiv:2402.02643 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.484917Z"},"links":{"cited_paper":"/paper/2402.02643","citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:9e9d25df34149e698d3f6174129519ffda90be5ac3ad15045dd7f48483ded36f","observation_id":"5bb2a721-f63c-48c5-a2eb-8118064d382a","resolution":{"observed_at":"2026-08-05T12:24:04.484917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29368","last_updated":"2026-05-28T05:12:41Z","snapshot_observed_at":"2026-08-18T20:15:48.599051Z","submitted_at":"2026-05-28T05:12:41Z","title":"SURGENT: A Surgical Multi-Agent Assistance System Across the Perioperative Workflow","version":1},"cited_work":{"arxiv_id":"2605.29368","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.29368","snapshot_observed_at":"2026-08-05T12:24:04.902132Z","title":"SURGENT: A Surgical Multi-Agent Assistance System Across the Perioperative Workflow","venue":"cs.CL","work_id":"de84dd88-f4fb-4363-937a-f3a2097d0077","year":2026},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.492422Z"},"links":{"cited_paper":"/paper/2605.29368","citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:b50739973aba16e0560ad4474b9792610121dd817971a63dee6db23d90d5a10d","observation_id":"a279a8b7-f56a-4594-aa83-7fd1922b9d11","resolution":{"observed_at":"2026-08-05T12:24:04.908009Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.20090","last_updated":"2026-07-22T12:45:04Z","snapshot_observed_at":"2026-08-16T00:03:55.807344Z","submitted_at":"2026-07-22T12:45:04Z","title":"Reinforcement Learning for Large Language Model Selective Evidence Adoption from Contaminated Retrieval Results","version":1},"cited_work":{"arxiv_id":"2607.20090","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.20090","snapshot_observed_at":"2026-08-05T12:24:04.870089Z","title":"Reinforcement Learning for Large Language Model Selective Evidence Adoption from Contaminated Retrieval Results","venue":"cs.CL","work_id":"951c5fa1-3396-40e0-acc7-30cc2caff3e6","year":2026},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.498229Z"},"links":{"cited_paper":"/paper/2607.20090","citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:a8c1c1ff65b4b015b0d5eacf503f492d4dfef9e504a08d796744db239b001a99","observation_id":"5805a705-e8a7-4634-92fb-a2a2cec8e469","resolution":{"observed_at":"2026-08-05T12:24:04.879414Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00136","last_updated":"2026-04-30T18:46:01Z","snapshot_observed_at":"2026-08-15T19:36:38.927380Z","submitted_at":"2026-04-30T18:46:01Z","title":"Are Tools All We Need? Unveiling the Tool-Use Tax in LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.00136","snapshot_observed_at":"2026-08-05T12:24:04.503426Z","title":"arXiv preprint arXiv:2605.00136 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.503426Z"},"links":{"cited_paper":"/paper/2605.00136","citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:a410c1f4beacf5f6dda3a59dba05447e0cf8b7dc83d74441a2fbc78461bd129f","observation_id":"a9fb90c7-e00e-451b-ac60-af0ba0d4987a","resolution":{"observed_at":"2026-08-05T12:24:04.503426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:05.232817Z","title":"2026 , eprint=","venue":null,"work_id":"8ead54d5-5ced-423f-981c-974f319fa67e","year":2026},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.508724Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:9b8233063eb8586711d8a95bbcf173cda0ae5fdde925034c6cffa5c9916e9bba","observation_id":"7e88d92e-6dfc-4c03-805d-b79f21490fa6","resolution":{"observed_at":"2026-08-05T12:24:05.238383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:05.215109Z","title":"Proceedings of the VLDB Endowment , volume=","venue":null,"work_id":"309d2e3a-bff1-44bb-a147-1dca14a140e6","year":2024},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.514488Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:3c58e9c1437ec679e783ab237a60843bfbe7fa6d0926a3d8f27b51c7adf0f1fa","observation_id":"b6898bf8-ca94-4f5d-9db3-94522e13528a","resolution":{"observed_at":"2026-08-05T12:24:05.220507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:04.520058Z","title":"Data Science and Engineering , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.520058Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:2478a23f6c88f7c0d87fa18145d3a0a31fcd81881f519fb04601e9bc90501f6e","observation_id":"b75a72ac-1f7d-46e2-9c1e-86ab5a729ca9","resolution":{"observed_at":"2026-08-05T12:24:04.520058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:04.524717Z","title":"S pider: A Large-Scale Human-Labeled Dataset for Complex and Cross-Domain Semantic Parsing and Text-to- SQL Task","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.524717Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:afd539ee2a81b672491cb6fb2b328e843567b85810b008f6b826205fd9525337","observation_id":"c09c4b7c-5fdd-491a-83e8-39e8d6bf6f9a","resolution":{"observed_at":"2026-08-05T12:24:04.524717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:04.529924Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.529924Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:e8f9604c597007504a19e24ad010f178f5538fe1f5321865675cd4067ee7612c","observation_id":"6bdc1cce-72d0-46c2-b27e-e636caba7936","resolution":{"observed_at":"2026-08-05T12:24:04.529924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:04.534698Z","title":"arXiv preprint arXiv:2403.02951 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.534698Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:d19223f915a02bccab091e7d948a2cebcd2cf21a78d63a261f353b5b2cd88cc2","observation_id":"2cec246e-a6a0-4e33-b74d-5b5bf449aa0f","resolution":{"observed_at":"2026-08-05T12:24:04.534698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:05.172076Z","title":"NeurIPS 2023 Foundation Models for Decision Making Workshop , year=","venue":null,"work_id":"626592c5-321f-4036-aeb2-c395421a6a9e","year":2023},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.540370Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:47c8bffe1c72da1aa77ced803170ea1652f67447c63a68e903d949806521d823","observation_id":"e0b92cb4-8495-4610-8eec-08636fa4eb78","resolution":{"observed_at":"2026-08-05T12:24:05.177479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:04.545965Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.545965Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:4495aa06d9ae9e70163c8164f54e0ea52d25aa2b056129edd371269698a7aa13","observation_id":"e26e7c73-d027-42de-98cd-1c0d6c922d30","resolution":{"observed_at":"2026-08-05T12:24:04.545965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:04.550375Z","title":"Proceedings of the national conference on artificial intelligence , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.550375Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:13e9ff953aedd6d8b648cb633fb0f1a6aeedf2cbd6ab8c0632156c33b1ae2782","observation_id":"85a8127b-44b3-4d00-a259-1e87efba0c2b","resolution":{"observed_at":"2026-08-05T12:24:04.550375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.04436","last_updated":"2017-11-13T06:41:29Z","snapshot_observed_at":"2026-08-14T20:14:24.852184Z","submitted_at":"2017-11-13T06:41:29Z","title":"SQLNet: Generating Structured Queries From Natural Language Without Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.04436","snapshot_observed_at":"2026-08-05T12:24:04.555107Z","title":"arXiv preprint arXiv:1711.04436 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.555107Z"},"links":{"cited_paper":"/paper/1711.04436","citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:5794630b10ed0b8f4279d6e77438221d0555953b22d407150d0cbfa9f96f5c17","observation_id":"a9980328-7a4e-4d3a-93e8-e546b0db2927","resolution":{"observed_at":"2026-08-05T12:24:04.555107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:04.560040Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.560040Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:6cef3c5f0c10f4e0ad5ad6219394542cddb69d3eda8f8481441e838eaa190f50","observation_id":"648490b1-04ea-4a9c-9864-282782699f24","resolution":{"observed_at":"2026-08-05T12:24:04.560040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:05.131974Z","title":"Handbook of linguistic annotation , pages=","venue":null,"work_id":"2e47399e-335e-41b2-b5e3-74780cf08021","year":2017},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.564610Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:e14f1d6cafe2b84c5726c5fb94686f89a9779661f9d4e6f3a10c955516faa307","observation_id":"31a827b1-03e7-4493-8904-9a0ba235fde2","resolution":{"observed_at":"2026-08-05T12:24:05.136915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:05.114782Z","title":"DATABASE DEVELOPMENT LIFE CYCLE , volume =","venue":null,"work_id":"f8d385b8-352b-45d5-8d7c-32535ffb0438","year":null},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.569027Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:b5013835a92a28aa7e561cb7e4f48380babf5792c61216401a7de9cb0a606c50","observation_id":"8c829c42-6653-4dbe-89a9-1ba68a7cdca2","resolution":{"observed_at":"2026-08-05T12:24:05.119878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:05.096724Z","title":"Statistical methods for rates and proportions , volume=","venue":null,"work_id":"509c6241-410f-4e14-938c-b2b43e397e3f","year":1981},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.573243Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:551921d64c99c9e17ca07ad8a1ae404b13712a9b09414102a5ee11b3a8f34fe9","observation_id":"b1337843-6934-4bc5-8749-0e7d31475143","resolution":{"observed_at":"2026-08-05T12:24:05.102345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08349","last_updated":"2024-11-29T14:44:27Z","snapshot_observed_at":"2026-08-17T05:11:34.898041Z","submitted_at":"2024-02-13T10:28:57Z","title":"Evaluating the Data Model Robustness of Text-to-SQL Systems Based on Real User Queries","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08349","snapshot_observed_at":"2026-08-05T12:24:04.578055Z","title":"arXiv preprint arXiv:2402.08349 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.578055Z"},"links":{"cited_paper":"/paper/2402.08349","citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:faf7897f25c06d0b60a27cf2952bea177b1713de0765e38f29d5ea34e5ef1d41","observation_id":"897a0be7-20a7-4700-a24b-194c89d340e4","resolution":{"observed_at":"2026-08-05T12:24:04.578055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:05.080802Z","title":"Clinical and Vaccine Immunology , volume=","venue":null,"work_id":"516bab6e-f375-4490-a302-d7fafb085971","year":2002},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.583457Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:b640138a5dd14c6b2e16925cb179c659d4f9ca83e8cba0f928f03c19763a24f9","observation_id":"d5b6f41f-e575-4ca8-bd4a-0fe76e152c0c","resolution":{"observed_at":"2026-08-05T12:24:05.085613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:05.062279Z","title":"2024 , eprint=","venue":null,"work_id":"ae1a46ea-1d64-4d35-b127-1aeb56a38d7b","year":2024},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.588299Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:f28b6a75ef1b4e7920af3db55c935c2f994053a69b252c5bf62684e174313948","observation_id":"dd0f4fa8-c510-4714-bf4a-78abdbceaf79","resolution":{"observed_at":"2026-08-05T12:24:05.067608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05378","last_updated":"2019-09-11T21:15:47Z","snapshot_observed_at":"2026-08-06T06:24:45.403805Z","submitted_at":"2019-09-11T21:15:47Z","title":"CoSQL: A Conversational Text-to-SQL Challenge Towards Cross-Domain Natural Language Interfaces to Databases","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05378","snapshot_observed_at":"2026-08-05T12:24:04.592803Z","title":"arXiv preprint arXiv:1909.05378 , year=","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.592803Z"},"links":{"cited_paper":"/paper/1909.05378","citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:a0e16bdd1eecc34da4172599257a312fb2d0cc0e93a05d4fbae5ca87a504d1a8","observation_id":"9e4361f8-5b97-4ca3-aad7-588438dde918","resolution":{"observed_at":"2026-08-05T12:24:04.592803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:05.044881Z","title":"Proceedings of the VLDB Endowment , volume=","venue":null,"work_id":"e6bc56f0-93c9-4d9c-82da-3b440b2d8e87","year":2025},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.597769Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:5ca3a58f9c95181d39e89beba0ba4158a7e754748ba4c615d0621d9731238fe1","observation_id":"52ab411c-8f49-4938-972e-ff1059a96081","resolution":{"observed_at":"2026-08-05T12:24:05.050123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:24:05.028969Z","title":"Proceedings of the 31st ACM SIGKDD Conference on Knowledge Discovery and Data Mining V","venue":null,"work_id":"77aa6792-c880-471b-a52b-2dafb77661b2","year":null},"citing_paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T12:24:04.602809Z"},"links":{"citing_paper":"/paper/2608.03794"},"observation_digest":"sha256:e4286950f998ef6523f0a9621047f227b784ecb2757371694aab21139fb91ea7","observation_id":"12eff54f-5531-473e-ae12-20a86b2ef5be","resolution":{"observed_at":"2026-08-05T12:24:05.033702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03794","last_updated":"2026-08-04T15:10:09Z","latest_version":1,"primary_category":"cs.DB","snapshot_observed_at":"2026-08-15T13:24:18.653243Z","submitted_at":"2026-08-04T15:10:09Z","title":"Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2608.03794."}