{"as_of":"2026-08-13T08:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:01c16855e13baa8fbcdd1eed1f989521a67dba12598eaf0db23aa6ed1beb3237","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:42:10.916116Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.16002/citation-record","integrity":"/paper/2411.16002/integrity","json":"/paper/2411.16002/citation-record.json","paper":"/paper/2411.16002"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-12T13:42:10.825545Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.825545Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:2f43e8972adac4f83e13c2f5aa7ecd729aa3efbc328168f726533c4d349829cb","observation_id":"50a12739-a968-4479-b0aa-5a3dadb49b37","resolution":{"observed_at":"2026-08-12T13:42:10.825545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07347","last_updated":"2021-05-11T23:29:14Z","snapshot_observed_at":"2026-08-10T01:13:53.702989Z","submitted_at":"2020-04-15T21:18:15Z","title":"HybridQA: A Dataset of Multi-Hop Question Answering over Tabular and Textual Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07347","snapshot_observed_at":"2026-08-12T13:42:10.830972Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.830972Z"},"links":{"cited_paper":"/paper/2004.07347","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:eb04b1e1b92483b9cfd0147e45ff083b1844652df7a7f49bdf07597982173d47","observation_id":"a6ca1041-7f71-40de-baab-d1d71e401910","resolution":{"observed_at":"2026-08-12T13:42:10.830972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18312","last_updated":"2024-05-06T09:16:15Z","snapshot_observed_at":"2026-08-13T04:08:16.139852Z","submitted_at":"2024-02-28T13:14:20Z","title":"How to think step-by-step: A mechanistic understanding of chain-of-thought reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18312","snapshot_observed_at":"2026-08-12T13:42:10.835765Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.835765Z"},"links":{"cited_paper":"/paper/2402.18312","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:23eba39642e646947d08aad30d449fa4d09d9964edb30727de2a031fc1f75f1a","observation_id":"351e91a7-b9af-40b6-b0bd-9c232f5a70a9","resolution":{"observed_at":"2026-08-12T13:42:10.835765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-12T13:42:10.841125Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.841125Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:a8a696f5421979e75751bd4370cbc325918582e2ffd25f0b9bec1ffe86b104c1","observation_id":"f3b2f3b9-87ec-4f61-9c3a-56481c7083e4","resolution":{"observed_at":"2026-08-12T13:42:10.841125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-12T13:42:10.845705Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.845705Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:ff99aec264f8c28b2e65f7512d39a0d7966a0e4a7d83b57c90d7a4e00e304f8a","observation_id":"f8de2f4a-a94b-45ee-b45e-bb8c86faacae","resolution":{"observed_at":"2026-08-12T13:42:10.845705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11610","last_updated":"2022-10-25T17:45:17Z","snapshot_observed_at":"2026-08-09T02:27:34.152063Z","submitted_at":"2022-10-20T21:53:54Z","title":"Large Language Models Can Self-Improve","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11610","snapshot_observed_at":"2026-08-12T13:42:10.850405Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.850405Z"},"links":{"cited_paper":"/paper/2210.11610","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:84fa7611ebd10fdafa16ea980efe5e2a0f30ccf50d0a3f4d44c6545a0c99ad1f","observation_id":"553d18ea-5071-476d-929a-6609567ae1db","resolution":{"observed_at":"2026-08-12T13:42:10.850405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:42:10.855612Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.855612Z"},"links":{"citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:0ed5e529f6a54891d2adbef06f7a7b8db3682ac33159e18401f85fa25011a7b8","observation_id":"a396b697-34ac-4269-87bc-b15166a6627a","resolution":{"observed_at":"2026-08-12T13:42:10.855612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15075","last_updated":"2023-10-23T16:33:23Z","snapshot_observed_at":"2026-08-13T05:42:58.154747Z","submitted_at":"2023-10-23T16:33:23Z","title":"TableQAKit: A Comprehensive and Practical Toolkit for Table-based Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15075","snapshot_observed_at":"2026-08-12T13:42:10.860036Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.860036Z"},"links":{"cited_paper":"/paper/2310.15075","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:749cde5f715fe9671dfe09028a38c9cd7e111fff0622ba450ca40f74b56ccdea","observation_id":"2ec0519a-0abc-4d32-88c6-d6d5090b431b","resolution":{"observed_at":"2026-08-12T13:42:10.860036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16634","last_updated":"2023-05-23T22:12:16Z","snapshot_observed_at":"2026-08-02T04:02:36.848064Z","submitted_at":"2023-03-29T12:46:54Z","title":"G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16634","snapshot_observed_at":"2026-08-12T13:42:10.864783Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.864783Z"},"links":{"cited_paper":"/paper/2303.16634","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:53a090812fe77ec02f4142856caa3be3eff83e50822c1c9277acf958732a83b3","observation_id":"fabe808e-35e0-4e1b-a206-080c7a860c2c","resolution":{"observed_at":"2026-08-12T13:42:10.864783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T13:42:10.869392Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.869392Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:d672f490787a8d34f8bc8657103901275afa4321c0ff9184567753ba04263c1f","observation_id":"b477cd16-41ff-4e5a-8ff7-e620397e9039","resolution":{"observed_at":"2026-08-12T13:42:10.869392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.00305","last_updated":"2015-08-03T02:53:01Z","snapshot_observed_at":"2026-07-06T04:25:37.491871Z","submitted_at":"2015-08-03T02:53:01Z","title":"Compositional Semantic Parsing on Semi-Structured Tables","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.00305","snapshot_observed_at":"2026-08-12T13:42:10.873853Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.873853Z"},"links":{"cited_paper":"/paper/1508.00305","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:d92e6f4e35d1d2f9ff6b0b9135c4acc08f602c04b57bfb144bcee05f5ed492b1","observation_id":"2a4a4ee0-03c8-4c03-81c0-b34fc5516844","resolution":{"observed_at":"2026-08-12T13:42:10.873853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:42:10.879791Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.879791Z"},"links":{"citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:95540a6fd8a6864bbdd3144d283ccfb0ecf9ad7365cd5b10e8a3553e4f9a8800","observation_id":"eac56dc8-68e6-416d-8d62-38eaab99e637","resolution":{"observed_at":"2026-08-12T13:42:10.879791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-12T13:42:10.883998Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.883998Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:94a31bb802b0186e814a6751cb7d29976c342a10396044c9bb96e18864286519","observation_id":"87bf950c-6164-4f1b-8432-7afbeda79524","resolution":{"observed_at":"2026-08-12T13:42:10.883998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04398","last_updated":"2024-01-19T01:05:05Z","snapshot_observed_at":"2026-08-13T04:46:47.723640Z","submitted_at":"2024-01-09T07:46:26Z","title":"Chain-of-Table: Evolving Tables in the Reasoning Chain for Table Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04398","snapshot_observed_at":"2026-08-12T13:42:10.888279Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.888279Z"},"links":{"cited_paper":"/paper/2401.04398","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:284f3c7c6bee9922c3b0fb89796273b73bf27b012dc08bc1c682a57a93923eda","observation_id":"ecc5d42e-401b-40e4-9599-e12f65f1683d","resolution":{"observed_at":"2026-08-12T13:42:10.888279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-12T13:42:10.892833Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.892833Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:2ad491828380b3778d45550e50a7143b43b0222bdce7bfabc03378273d37fbf7","observation_id":"8553994c-4008-4726-839d-31de4157bb30","resolution":{"observed_at":"2026-08-12T13:42:10.892833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14987","last_updated":"2023-10-30T22:00:25Z","snapshot_observed_at":"2026-08-10T08:15:34.911054Z","submitted_at":"2023-05-24T10:22:30Z","title":"Investigating Table-to-Text Generation Capabilities of LLMs in Real-World Information Seeking Scenarios","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14987","snapshot_observed_at":"2026-08-12T13:42:10.897402Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.897402Z"},"links":{"cited_paper":"/paper/2305.14987","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:f44c98e3c3d58cfa18dfb246a3aba05b58fc75ba51f934f86f8ec194096e5101","observation_id":"9f38e36f-b1e9-4d08-aa7d-af0e8b1a1b15","resolution":{"observed_at":"2026-08-12T13:42:10.897402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10625","last_updated":"2023-04-16T22:08:08Z","snapshot_observed_at":"2026-08-06T09:00:42.886249Z","submitted_at":"2022-05-21T15:34:53Z","title":"Least-to-Most Prompting Enables Complex Reasoning in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10625","snapshot_observed_at":"2026-08-12T13:42:10.901881Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.901881Z"},"links":{"cited_paper":"/paper/2205.10625","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:4765e4dab421ef53094e61f9c393600e538e1582b56012428df6ebe7ccc0f40e","observation_id":"3452dce9-7734-4518-9cee-0583fe244300","resolution":{"observed_at":"2026-08-12T13:42:10.901881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.07624","last_updated":"2021-06-01T05:38:50Z","snapshot_observed_at":"2026-08-12T20:59:46.367520Z","submitted_at":"2021-05-17T06:12:06Z","title":"TAT-QA: A Question Answering Benchmark on a Hybrid of Tabular and Textual Content in Finance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.07624","snapshot_observed_at":"2026-08-12T13:42:10.906249Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.906249Z"},"links":{"cited_paper":"/paper/2105.07624","citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:8a735f31a66f3888ecf669a2626fe1845821e8fa98ffac35f655fef0a8afb9ef","observation_id":"03f39fa5-4bc7-4d2c-9946-8ca19fb14838","resolution":{"observed_at":"2026-08-12T13:42:10.906249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:42:10.910972Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.910972Z"},"links":{"citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:d28fa94fe3b102045b6f3dc62c755bb756e2191904f91d11db7eca14e5c7dfae","observation_id":"8aeb60df-2214-49ee-ae2e-044f14cefe1f","resolution":{"observed_at":"2026-08-12T13:42:10.910972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:42:10.916116Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T13:42:10.916116Z"},"links":{"citing_paper":"/paper/2411.16002"},"observation_digest":"sha256:74efcc7747a2b6689a349db27ad87a80993b2f910d52085344858d86e676b951","observation_id":"c63defe6-79eb-47e6-befb-361c23329ad0","resolution":{"observed_at":"2026-08-12T13:42:10.916116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.16002","last_updated":"2024-11-24T22:48:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T20:32:10.315586Z","submitted_at":"2024-11-24T22:48:44Z","title":"Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2411.16002."}