{"as_of":"2026-08-20T08:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7f488d344e118d2333fc3f867aaa916fb2409fd08747ecd4958c77b725dca05d","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:51:57.106372Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.21575/citation-record","integrity":"/paper/2505.21575/integrity","json":"/paper/2505.21575/citation-record.json","paper":"/paper/2505.21575"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:54.771353Z","title":"Language models are few-shot learners.Advances in neural infor- mation processing systems, 33:1877–1901, 2020","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:54.771353Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:4ed070bb29edd5d806ece684c9c48fc8aecfe3176450956b414bf79e7871b6d2","observation_id":"71f0964d-c5c2-4f17-bce3-378b21acf746","resolution":{"observed_at":"2026-08-07T13:51:54.771353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:52:00.717377Z","title":"Spark: Cluster computing with working sets","venue":null,"work_id":"7a657de9-c216-4535-be4a-29f049061901","year":2010},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:54.897449Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:b1c6d95134412bab93b24d3074932ca7cac0b40f87c4b5af0f17cc0520c9591d","observation_id":"1119dc3c-2c8d-44bb-9d4e-d112abbc43ed","resolution":{"observed_at":"2026-08-07T13:52:00.805959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:52:00.552765Z","title":"Data-intensive applications, challenges, techniques and technologies: A survey on big data.Information sciences, 275:314– 347, 2014","venue":null,"work_id":"e96673a0-0f16-4a2d-85b3-e801d606ddd1","year":2014},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:54.988079Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:88cc7eec5c83a8bed5f1996fd5de0d62bb91dd0025a223ebd36b95c784423078","observation_id":"f3ffafcb-5a1c-49e7-9f90-7036a7001915","resolution":{"observed_at":"2026-08-07T13:52:00.605885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:52:00.361049Z","title":"Data-intensive science: a new paradigm for biodiversity studies.BioScience, 59(7):613–620, 2009","venue":null,"work_id":"303938dd-37dd-46d2-a90e-840dc09fcbbd","year":2009},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.062786Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:a6a9abad92a60746283c05b34b97a3bcd7b4b87deb4450067e1695da105ca95d","observation_id":"0aedc9eb-7898-48e9-ad92-6c98e4f80084","resolution":{"observed_at":"2026-08-07T13:52:00.441536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:52:00.170356Z","title":"Oxford University Press, 2007","venue":null,"work_id":"55d5a13b-7051-496f-9fcf-340882c181aa","year":2007},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.131299Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:5550a848bbc57d70e2e71decc81bc1887a93db801dc488da4156e0956acf711e","observation_id":"608880af-fee0-4cfc-a2df-cb1e37f7557b","resolution":{"observed_at":"2026-08-07T13:52:00.274383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:59.884858Z","title":"Big data storage technologies: a survey.Frontiers of Information Technology & Electronic Engineering, 18:1040– 1070, 2017","venue":null,"work_id":"a8f35b27-5937-432c-8d52-a4cbed094d44","year":2017},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.201207Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:b5d10643c88f0a69367dfe9e272a279daaa1a17ee05b02a2d04e4c2b05b9371e","observation_id":"14f06c65-2ce7-4910-89c2-1594e4e2add7","resolution":{"observed_at":"2026-08-07T13:52:00.049522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:59.591540Z","title":"Big data visualization: Tools and challenges","venue":null,"work_id":"ccd383a5-269e-4b7a-ac0d-2330070e13ed","year":2016},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.316289Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:cf77e4f613a90ce05dc5d9ff7d08938158e43b2a4725a8ae06a3e3a10694c204","observation_id":"27dce887-99af-4beb-ae85-d6ae3081ae7f","resolution":{"observed_at":"2026-08-07T13:51:59.736831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:59.376524Z","title":"The uspto patent assignment dataset: Descriptions and analysis","venue":null,"work_id":"0dce8975-4900-47ea-bdf3-b1bb6ca80137","year":2015},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.439030Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:96611e77816fea3bdce403ff260cc23cb09cf124ae1fbc634c35f32e32d0d503","observation_id":"2a9e6dad-c644-4dd7-a667-a3a3cd2a1af4","resolution":{"observed_at":"2026-08-07T13:51:59.465366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:59.144894Z","title":"Structured query language (sql) fundamentals.Current protocols in bioinformatics, (1):9–2, 2003","venue":null,"work_id":"21864cf3-8250-44ef-94e6-678673f50e65","year":2003},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.555266Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:27ef10d4bcc8919cd458f3a962284ef62dbbc6391027d0bde5a573bfe291a6ca","observation_id":"917b64ec-d83f-47b4-9939-238e623d7e9e","resolution":{"observed_at":"2026-08-07T13:51:59.252878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:58.924080Z","title":"Graphix-t5: Mixing pre-trained transformers with graph-aware layers for text-to-sql parsing","venue":null,"work_id":"48a10018-e9a1-4d78-969f-46e11e61e54b","year":2023},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.586094Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:ecba7f92d4916b7ee9fa2bdcd4950f141f465320af6aa9ef2d92f99e0a99aa02","observation_id":"4d001e1d-1b97-4a10-b4d5-e993e57e5df9","resolution":{"observed_at":"2026-08-07T13:51:59.034397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:58.736460Z","title":"N-best hypotheses reranking for text-to-sql systems","venue":null,"work_id":"13f791d0-50f1-4429-b1b7-d1a74d93b9a6","year":2023},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.621208Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:a7e4f0c790a9da814197c26f2f267d2d1d11aeeefd68e93dd8cf282746a2a713","observation_id":"8d5d361c-a09f-49da-b9d9-9cc4caff4932","resolution":{"observed_at":"2026-08-07T13:51:58.811191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08785","last_updated":"2022-12-17T02:53:21Z","snapshot_observed_at":"2026-08-19T20:37:41.377045Z","submitted_at":"2022-12-17T02:53:21Z","title":"Importance of Synthesizing High-quality Data for Text-to-SQL Parsing","version":1},"cited_work":{"arxiv_id":"2212.08785","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.08785","snapshot_observed_at":"2026-08-07T13:51:57.634334Z","title":"Importance of Synthesizing High-quality Data for Text-to-SQL Parsing","venue":"cs.CL","work_id":"8010f6a3-54da-4cc8-98a9-32299b572577","year":2022},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.668461Z"},"links":{"cited_paper":"/paper/2212.08785","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:9583ddea08457a50e16861a64b18aeff6b3f70de29d8de1cda7eba9e7627d63a","observation_id":"9ff1aaa3-e11b-419f-8394-39521d04dd42","resolution":{"observed_at":"2026-08-07T13:51:57.691125Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T13:51:55.753489Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.753489Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:cf58945a0b310c87badcc2dc2fa1e1f504c34a1ac3de8b826dcea1e9b0ebb5e7","observation_id":"a5ee4d38-826d-499d-a914-da21835b7b8a","resolution":{"observed_at":"2026-08-07T13:51:55.753489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-08-14T05:02:11.716316Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-07T13:51:55.822846Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks.arXiv preprint arXiv:1908.10084, 2019","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.822846Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:0e294977fd7d8cd0cbb39e4270da6cc8e4d983971c6b5bd552db8b34d606419b","observation_id":"320df163-6b32-466a-93fc-41051ba762c4","resolution":{"observed_at":"2026-08-07T13:51:55.822846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:58.624115Z","title":"Layout evaluation of large capacity warehouses.Facilities, 25(7/8):259–270, 2007","venue":null,"work_id":"34884adc-52a2-4a04-82e1-d4a7343dc9c5","year":2007},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.887739Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:54d7429e1ee273cf0dd24648a67bb42e814382b76d710ab855ad5a826f9b7883","observation_id":"fd85efe7-7640-4480-ad6e-46038fef08e9","resolution":{"observed_at":"2026-08-07T13:51:58.670267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:58.500858Z","title":"Sql: From traditional databases to big data","venue":null,"work_id":"7f4c7f18-2bb3-421b-bf74-61b3253d1a14","year":2016},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:55.997878Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:a49794c008bf617ff8f95258aa8544f46b5291ea38359551e40e791c900ef8ce","observation_id":"9df8a72e-018c-4dfd-bbf1-0798ef4d1ae7","resolution":{"observed_at":"2026-08-07T13:51:58.544169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:58.373389Z","title":null,"venue":null,"work_id":"68eefdbf-6861-4c1f-96f8-e0239d2534dd","year":null},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.063239Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:b753b28cdf3ed51ea5165b9d4d6cb258ad038ef9737d5bc65ef69653e614c6ce","observation_id":"8c3fe810-0acd-4daa-838d-e9d2972dba9f","resolution":{"observed_at":"2026-08-07T13:51:58.443250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:58.212655Z","title":"Valuenet: A natural language-to-sql system that learns from database information","venue":null,"work_id":"9c2b7c16-b8bc-4ad7-aae9-c4bef998c12a","year":2021},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.123980Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:a68e2f067cc00e3d729dd56272fbb24717b446be34463a2ac76bbe1b010accc4","observation_id":"0ac0b394-16b3-4d4a-a93c-fdbe0c773729","resolution":{"observed_at":"2026-08-07T13:51:58.306914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T13:51:56.186549Z","title":"Lora: Low-rank adaptation of large language models.arXiv preprint arXiv:2106.09685, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.186549Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:f29094aa348e30cfc6b22ab120cfb161d9b981479aa47b04a99ecb1cdb25bb70","observation_id":"ea9028f4-6b9c-4cf5-bce0-b192ca5e074f","resolution":{"observed_at":"2026-08-07T13:51:56.186549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.00103","last_updated":"2017-11-09T23:06:14Z","snapshot_observed_at":"2026-08-16T12:20:26.377960Z","submitted_at":"2017-08-31T23:12:15Z","title":"Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.00103","snapshot_observed_at":"2026-08-07T13:51:56.271142Z","title":"Seq2sql: Generating struc- tured queries from natural language using reinforcement learning.CoRR, abs/1709.00103, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.271142Z"},"links":{"cited_paper":"/paper/1709.00103","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:1a6fc2511db47559f7c41ca4e24c70169dc5b661dea0631dfe86efe98152006a","observation_id":"29c7764d-9742-4a6f-bc23-5160b8cab383","resolution":{"observed_at":"2026-08-07T13:51:56.271142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.08887","last_updated":"2019-02-02T23:53:18Z","snapshot_observed_at":"2026-08-18T17:54:32.989741Z","submitted_at":"2018-09-24T13:03:13Z","title":"Spider: A Large-Scale Human-Labeled Dataset for Complex and Cross-Domain Semantic Parsing and Text-to-SQL Task","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.08887","snapshot_observed_at":"2026-08-07T13:51:56.335835Z","title":"Spider: A large-scale human- labeled dataset for complex and cross-domain semantic parsing and text-to-sql task.arXiv preprint arXiv:1809.08887, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.335835Z"},"links":{"cited_paper":"/paper/1809.08887","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:d3c317b338b8459063a40563f7499ee97107995b91ae73ca4b030553c1d4b1db","observation_id":"0df83c74-a2b7-47d3-add4-b9452710d532","resolution":{"observed_at":"2026-08-07T13:51:56.335835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:58.089025Z","title":"Nginx: the high-performance web server and reverse proxy.Linux Journal, 2008(173):2, 2008","venue":null,"work_id":"756fbfbf-7b92-4a1a-a8e5-41bb9b7a9bad","year":2008},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.421093Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:e8285d3c3cb62b46881d7c1bd4df779e5e233be9a7bca3b5e0f8f5e24ed5f0c8","observation_id":"2f81deff-780e-4b15-aea9-342d818c803f","resolution":{"observed_at":"2026-08-07T13:51:58.132681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:57.916379Z","title":"Round robin scheduling–a survey","venue":null,"work_id":"203b1902-afab-49b7-afde-04079ae5d068","year":2008},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.497809Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:c5b8725dea29c61a7943663f1a3be158008ccd400be718252056f59820e5cf9c","observation_id":"79068e3f-9f15-4156-9139-5c5031b81c7d","resolution":{"observed_at":"2026-08-07T13:51:58.007137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:57.762648Z","title":"Efficient and scalable multiprocessor fair scheduling using distributed weighted round-robin.ACM Sigplan Notices, 44(4):65–74, 2009","venue":null,"work_id":"d5c1d921-91a5-4228-9f98-939303fd008d","year":2009},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.572090Z"},"links":{"citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:82d12a2bc1206bff054b03f640bac80499b17b29f3f6c8859a41e2773ccf6cca","observation_id":"06c9674e-7d1b-4196-b427-16eb78d3f8f9","resolution":{"observed_at":"2026-08-07T13:51:57.852660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.05153","last_updated":"2021-09-11T01:53:55Z","snapshot_observed_at":"2026-08-16T17:57:24.688760Z","submitted_at":"2021-09-11T01:53:55Z","title":"Natural SQL: Making SQL Easier to Infer from Natural Language Specifications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.05153","snapshot_observed_at":"2026-08-07T13:51:56.633332Z","title":"Natural sql: Making sql easier to infer from natural language specifications.arXiv preprint arXiv:2109.05153, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.633332Z"},"links":{"cited_paper":"/paper/2109.05153","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:6ab7ddd3973ffee266dd0e9c6d80adf813fbe83c09e2b36b9e9069df30f80b77","observation_id":"c1200792-bc82-4c7c-b343-e72f865da12d","resolution":{"observed_at":"2026-08-07T13:51:56.633332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13845","last_updated":"2021-05-29T01:30:29Z","snapshot_observed_at":"2026-08-14T21:38:10.388234Z","submitted_at":"2020-09-29T08:17:58Z","title":"GraPPa: Grammar-Augmented Pre-Training for Table Semantic Parsing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.13845","snapshot_observed_at":"2026-08-07T13:51:56.694851Z","title":"Grappa: Grammar-augmented pre-training for table semantic parsing.arXiv preprint arXiv:2009.13845, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.694851Z"},"links":{"cited_paper":"/paper/2009.13845","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:a05bc036004232855ea3f161a6d03cc43063245d98fac9fb899b81abaa381e48","observation_id":"bceeaeaa-a1b7-43af-877a-470a65d07034","resolution":{"observed_at":"2026-08-07T13:51:56.694851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06958","last_updated":"2022-03-14T09:49:15Z","snapshot_observed_at":"2026-08-16T17:14:51.308983Z","submitted_at":"2022-03-14T09:49:15Z","title":"S$^2$SQL: Injecting Syntax to Question-Schema Interaction Graph Encoder for Text-to-SQL Parsers","version":1},"cited_work":{"arxiv_id":"2203.06958","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.06958","snapshot_observed_at":"2026-08-07T13:51:57.396668Z","title":"S$^2$SQL: Injecting Syntax to Question-Schema Interaction Graph Encoder for Text-to-SQL Parsers","venue":"cs.CL","work_id":"f8e5301d-30f5-497b-aff1-ac7d6b457c10","year":2022},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.752826Z"},"links":{"cited_paper":"/paper/2203.06958","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:99146a9826dbb79b6472b37232cab46d1334694876430daa3b287837bb237422","observation_id":"7d4f3a4d-26a8-4db7-91be-e1d6bcfbcd76","resolution":{"observed_at":"2026-08-07T13:51:57.446575Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.05093","last_updated":"2021-09-10T20:14:08Z","snapshot_observed_at":"2026-08-16T17:57:26.877848Z","submitted_at":"2021-09-10T20:14:08Z","title":"PICARD: Parsing Incrementally for Constrained Auto-Regressive Decoding from Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.05093","snapshot_observed_at":"2026-08-07T13:51:56.852473Z","title":"Picard: Parsing incrementally for constrained auto-regressive decoding from language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.852473Z"},"links":{"cited_paper":"/paper/2109.05093","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:5853a0153dad65db8def4c868ea0d1551ed61e6816e2d02afe8b9fdd7f633855","observation_id":"d015e4df-96d0-412c-848e-7dcd4b5fcea9","resolution":{"observed_at":"2026-08-07T13:51:56.852473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06983","last_updated":"2022-10-09T07:01:11Z","snapshot_observed_at":"2026-08-16T17:00:22.863464Z","submitted_at":"2022-05-14T06:27:40Z","title":"RASAT: Integrating Relational Structures into Pretrained Seq2Seq Model for Text-to-SQL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06983","snapshot_observed_at":"2026-08-07T13:51:56.951585Z","title":"Rasat: Integrating rela- tional structures into pretrained seq2seq model for text-to-sql.arXiv preprint arXiv:2205.06983, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:56.951585Z"},"links":{"cited_paper":"/paper/2205.06983","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:1b72fe0622cf7915ed6648b20e15783c3ecf1e40f6f5586d029283d6c81bc108","observation_id":"9dbc0f61-464d-4468-a1e5-e9875db7a564","resolution":{"observed_at":"2026-08-07T13:51:56.951585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.12773","last_updated":"2022-08-31T00:19:41Z","snapshot_observed_at":"2026-08-16T19:10:59.038803Z","submitted_at":"2020-10-24T04:35:35Z","title":"Structure-Grounded Pretraining for Text-to-SQL","version":3},"cited_work":{"arxiv_id":"2010.12773","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.12773","snapshot_observed_at":"2026-08-07T13:51:57.255077Z","title":"Structure-Grounded Pretraining for Text-to-SQL","venue":"cs.CL","work_id":"f84a5500-0d95-4233-a8de-a9149333f69b","year":2020},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:57.053714Z"},"links":{"cited_paper":"/paper/2010.12773","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:4211b59d0bcfe9af7e093d143b6786bb0a7bb2ce7cfbc9afb6c9abea414b823a","observation_id":"9a96e0df-2c8e-4ad4-bcba-6afc02fbc555","resolution":{"observed_at":"2026-08-07T13:51:57.289319Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T13:51:57.106372Z","title":"Bert: Pre- training of deep bidirectional transformers for language understanding.arXiv preprint arXiv:1810.04805, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:51:57.106372Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.21575"},"observation_digest":"sha256:621d92c6c2152ba964e8405dad303bb02a3820a3ddacf88397235f4fe3d5495a","observation_id":"5fa909e5-cfd2-4a97-9803-4782d760d663","resolution":{"observed_at":"2026-08-07T13:51:57.106372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.21575","last_updated":"2025-05-27T07:44:16Z","latest_version":1,"primary_category":"cs.DB","snapshot_observed_at":"2026-08-17T19:42:06.432789Z","submitted_at":"2025-05-27T07:44:16Z","title":"StreamLink: Large-Language-Model Driven Distributed Data Engineering System"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":3,"verified_fuzzy":16},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2505.21575."}