{"as_of":"2026-08-08T14:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b1bf16a8445e63ab8e8e2ecb91d0b197dcc65f526c24ef4088dbf6b50ca55050","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T19:00:50.562995Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.10215/citation-record","integrity":"/paper/2502.10215/integrity","json":"/paper/2502.10215/citation-record.json","paper":"/paper/2502.10215"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T19:00:50.435018Z","title":", Aneja, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.435018Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:97e7369d7b224525945cd26ab30f497f1578803160c9462dc5c4a0875e8e2670","observation_id":"11d63381-a9d5-4d83-8118-98a6ef2d72f5","resolution":{"observed_at":"2026-08-07T19:00:50.435018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01425","last_updated":"2023-10-04T18:10:30Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-09-27T16:15:34Z","title":"Borges and AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01425","snapshot_observed_at":"2026-08-07T19:00:50.442007Z","title":"\\ Sch \\\"o lkopf, B","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.442007Z"},"links":{"cited_paper":"/paper/2310.01425","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:b150e858ae663c7177b1bfcbc4c9d608008a930d7831a0d72d800c2ddcfe767a","observation_id":"98940a04-d731-423c-9903-6201809434ad","resolution":{"observed_at":"2026-08-07T19:00:50.442007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:51.045886Z","title":", Lagnado, D A","venue":null,"work_id":"89cccdc5-3062-4cf6-a8f1-274f17b9c5bd","year":2015},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.446121Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:14b0b1d98e9a5cb260cd16ba18e17fe286d1853c19e3da27877108eeae013c3d","observation_id":"7209f95f-11d4-4fd9-bd22-142b90e9b5a3","resolution":{"observed_at":"2026-08-07T19:00:51.049606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-07T19:00:50.451001Z","title":", Chandrasekaran, V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.451001Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:cb227a911cae81c114d64b465ae12b794afa9a5897ff36f90b85ed862422b34f","observation_id":"6f4bec35-2d3d-4b8f-bdc0-0f3f8a3141e5","resolution":{"observed_at":"2026-08-07T19:00:50.451001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:51.035230Z","title":"APACrefauthors \\ 1997","venue":null,"work_id":"909ee025-5fed-4112-890e-a5bb263b5546","year":1997},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.455015Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:c75b5889a58ce0c4cc33f2a16a2c341038536c7d72e95d5bf667ea302a605941","observation_id":"3ec82d8c-ea64-41e3-a287-11c4dfc5b680","resolution":{"observed_at":"2026-08-07T19:00:51.038831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:51.021703Z","title":", Hahn, U","venue":null,"work_id":"eef6a91f-2ae7-45a5-b6a4-00baa885cf18","year":2020},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.458703Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:a7c896594bcca70d2266a4aa2862ccee83dda095a2210a18a6cd1617a1f98311","observation_id":"036d1831-8f2f-4342-8848-4d8f8129b7fe","resolution":{"observed_at":"2026-08-07T19:00:51.026599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:51.008006Z","title":"\\ Rehder, B","venue":null,"work_id":"868a7877-cbd8-4ebb-bced-d20624465985","year":2020},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.464494Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:4a98566b7fb6b80e3a64b6a92ad2d8670c56c0171b6f6cfad03f755f4c11bf84","observation_id":"c9ba285b-4db1-43cb-b4b4-ef4d516a9af1","resolution":{"observed_at":"2026-08-07T19:00:51.013175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.988141Z","title":"APACrefauthors \\ 2003","venue":null,"work_id":"ece02e87-4dfd-4598-8ce4-7bfb33b00c3f","year":2003},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.468678Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:22b7741787caf0d7ca9cfecce1fbd894ad7cb82beee45cf9035fdecc4fb09498","observation_id":"1e65b964-4a3c-4dd3-938c-ff6fb2dab6e8","resolution":{"observed_at":"2026-08-07T19:00:50.993058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.472721Z","title":", Wang, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.472721Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:2b2eef2017b086837eb5cf5f0b623f1f84daf469cfdb14313832456684752195","observation_id":"239442d9-6dc2-4165-97ea-089c60368168","resolution":{"observed_at":"2026-08-07T19:00:50.472721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11050","last_updated":"2024-10-04T04:40:03Z","snapshot_observed_at":"2026-07-06T18:31:49.437336Z","submitted_at":"2024-06-16T19:22:53Z","title":"A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11050","snapshot_observed_at":"2026-08-07T19:00:50.476845Z","title":", Xie, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.476845Z"},"links":{"cited_paper":"/paper/2406.11050","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:e6fd97e23a98544ed509695032c638798c4ec81a9d095a4a7965fcfe588e5eab","observation_id":"87db11a4-e2e7-44c4-b86d-7bdc9521e13f","resolution":{"observed_at":"2026-08-07T19:00:50.476845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04350","last_updated":"2024-01-17T14:41:55Z","snapshot_observed_at":"2026-08-04T10:35:58.738226Z","submitted_at":"2023-12-07T15:12:12Z","title":"CLadder: Assessing Causal Reasoning in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04350","snapshot_observed_at":"2026-08-07T19:00:50.481238Z","title":", Chen, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.481238Z"},"links":{"cited_paper":"/paper/2312.04350","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:e3e2ee081bd3ea7f7c8fe791f42dad558648eac8d72791f9065d52b8a39009fc","observation_id":"076e1d91-30e5-48d7-9803-3032b38a02a2","resolution":{"observed_at":"2026-08-07T19:00:50.481238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.976541Z","title":"\\ Busemeyer, J R","venue":null,"work_id":"7837e50d-461b-4770-af24-91bcdb4b6ea6","year":2016},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.485606Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:8bd02c200fcc1f6188a09045c2d4b5b8a169b99d2f46bffd99cf8a90dab8df2f","observation_id":"27a6f6ba-4606-4446-827e-24ec14a8e4e4","resolution":{"observed_at":"2026-08-07T19:00:50.980571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.964819Z","title":"u gelgen, J. , Priesemann, V. \\ Sch \\","venue":null,"work_id":"38a1d80c-8378-452c-a46a-36069282102d","year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.489662Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:215d112f8bd4d466bdc73dbb5524a1c02de38b0b1d184e60f8b8c61e6a5dc821","observation_id":"f0ab1141-f197-4b85-9c87-af5c4e0b898f","resolution":{"observed_at":"2026-08-07T19:00:50.969035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.953656Z","title":", Willig, M","venue":null,"work_id":"8442d86a-1511-4455-8c5d-63ccc9b107a2","year":2024},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.493672Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:dfd2dde5194445ae55fa3d01dbc94961e72e554192a4ff11737917746ca686ca","observation_id":"2f96ad58-2c7b-4852-a281-4f636dc9cde8","resolution":{"observed_at":"2026-08-07T19:00:50.957411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.00050","last_updated":"2024-08-20T17:16:20Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T19:00:43Z","title":"Causal Reasoning and Large Language Models: Opening a New Frontier for Causality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.00050","snapshot_observed_at":"2026-08-07T19:00:50.497799Z","title":", Ness, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.497799Z"},"links":{"cited_paper":"/paper/2305.00050","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:e6b44c8085f23006ae001f4998ac18f3fc6d1b709bac6f63ece67867d4828ea0","observation_id":"95048b32-d9c0-4b37-abb8-9142b27cc750","resolution":{"observed_at":"2026-08-07T19:00:50.497799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.941350Z","title":", Ullman, T D","venue":null,"work_id":"71469dce-64ff-4ad2-9abb-63b3f2e405e2","year":2017},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.503302Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:28c71425330438e7be926269ae290be891ecb6fcc479a3a387ae63c1018300e5","observation_id":"398e8bf8-2a04-4cba-ad76-40eb11529ce4","resolution":{"observed_at":"2026-08-07T19:00:50.945435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.928737Z","title":", Griffiths, T","venue":null,"work_id":"36df4d63-b0e1-4583-a6ad-11866cf9a331","year":2012},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.507719Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:7545f3986baa085ff88e2dcae54902e8db377e81904ab844e32af3b9c52ce404","observation_id":"97e400e8-7267-45ca-ba3a-d6a988ff0a9c","resolution":{"observed_at":"2026-08-07T19:00:50.932933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-07T19:00:50.512418Z","title":", Alizadeh, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.512418Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:e7b785edaf0ae2ecc6383219126d610bffc3f34e1de4689000f0716560ffbc28","observation_id":"ed1f2d4d-30f6-4b24-a245-c77f6151ec75","resolution":{"observed_at":"2026-08-07T19:00:50.512418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.914769Z","title":"\\ Krakauer, D C","venue":null,"work_id":"f22a8f10-2dcc-4ed4-aa1a-04e26cfe3caa","year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.517987Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:d37767ba3d721d717e7913f4200f9338d1826e468f9e038a3189fda19e4b2c18","observation_id":"f13a9901-820e-4578-934b-cf2b4daea5b0","resolution":{"observed_at":"2026-08-07T19:00:50.919681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.895222Z","title":"\\ Larrick, R P","venue":null,"work_id":"b1376e9b-e946-4136-9d5c-adee20058163","year":1995},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.524427Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:03ece00eb05cd9eb36df057138945e702324d7927278cbebd174d3578edaefad","observation_id":"5c2488d4-3522-478a-b0c8-a6144950fb77","resolution":{"observed_at":"2026-08-07T19:00:50.899326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13375","last_updated":"2023-04-12T16:48:39Z","snapshot_observed_at":"2026-07-06T15:07:11.623462Z","submitted_at":"2023-03-20T16:18:38Z","title":"Capabilities of GPT-4 on Medical Challenge Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13375","snapshot_observed_at":"2026-08-07T19:00:50.529867Z","title":", King, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.529867Z"},"links":{"cited_paper":"/paper/2303.13375","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:1ec08e3f5d21a42465fb6f30ebc17e7c0b0bedc6de782f995aaa5aa45f8a64a2","observation_id":"8bb5ae64-8552-4e12-be92-87010ef827f4","resolution":{"observed_at":"2026-08-07T19:00:50.529867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.881150Z","title":"APACrefauthors \\ 2023","venue":null,"work_id":"0432f1de-3f34-4fa8-9ac5-d08bc3ec750c","year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.534513Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:535b8441861d971af8eae4ccdf08c0606c1aa5ad3b2706feb3dcad7608087dfc","observation_id":"7080e58b-60ef-45fc-a368-1fa4bf5c3987","resolution":{"observed_at":"2026-08-07T19:00:50.885207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.866806Z","title":"APACrefauthors \\ 1995","venue":null,"work_id":"ac5d3db5-50ff-4440-a507-25ba4710231a","year":1995},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.538411Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:cea29bfeb91d39abc7a3c891bd291661b50ab9a58156c871010b42153ced7c65","observation_id":"cc928161-102c-4a7b-ae79-1f3a382deccd","resolution":{"observed_at":"2026-08-07T19:00:50.872267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.852135Z","title":"APACrefauthors \\ 2024","venue":null,"work_id":"1ab7862a-bf1a-4748-89ea-86ac8706f73e","year":2024},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.542781Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:e0c69d694157aa2ab66dab490eaa23d56502d0bb9cfbf1ffc8f469d09d38d64f","observation_id":"b9c63010-4e8a-4ff0-946a-60a4e6805a50","resolution":{"observed_at":"2026-08-07T19:00:50.856443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.838870Z","title":"\\ Waldmann, M R","venue":null,"work_id":"b2a41127-3b79-4ad2-aeec-4dcb399cdbcb","year":2017},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.546927Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:5707d1483d17e36729398a4db4662cd88a141906aeea86bf796bfdad91e85c5b","observation_id":"46e1cf7e-9d29-4b6b-862c-a6ddd0baef27","resolution":{"observed_at":"2026-08-07T19:00:50.843347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.826343Z","title":", Chen, X","venue":null,"work_id":"742d49de-2fcd-4f1c-b073-e68e2dec89ae","year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.550929Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:ea1aa638340788a8dae8236af4e30311bcc21d66f6dd274fc9f2bd987b6c5c90","observation_id":"ee3211bf-4dc3-47b1-b940-8541d581af7d","resolution":{"observed_at":"2026-08-07T19:00:50.830296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.814618Z","title":", Goodman, N","venue":null,"work_id":"88e608ad-fd3a-45a4-86b2-32d04103a0c3","year":2014},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.554850Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:f71d5b1d348fcbd1d99fb9de15cd89c5c1ffeb1a6ce3bb0547249b44337e5779","observation_id":"9e81dd36-293d-4d71-a7f4-ce4a9b6944d4","resolution":{"observed_at":"2026-08-07T19:00:50.818109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.802302Z","title":", Hagmayer, Y","venue":null,"work_id":"d92cee7e-3cf6-4a58-b233-725912fc56d3","year":2006},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.559003Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:dd2edcd0e1cf5029a1f380b6d795a84c4114d13c9c05617f85c011950736bcc8","observation_id":"cd47205e-547f-451f-8d0a-ef7b0f5302d1","resolution":{"observed_at":"2026-08-07T19:00:50.806836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13067","last_updated":"2023-08-24T20:23:13Z","snapshot_observed_at":"2026-07-06T16:10:11.901106Z","submitted_at":"2023-08-24T20:23:13Z","title":"Causal Parrots: Large Language Models May Talk Causality But Are Not Causal","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13067","snapshot_observed_at":"2026-08-07T19:00:50.562995Z","title":", Zecevic, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.562995Z"},"links":{"cited_paper":"/paper/2308.13067","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:01d3b22ed9b168d34cbc056af0bac7c02e4dd031529d43b417b93eb50ced26b7","observation_id":"38ce1225-2524-4a4c-9fbc-06d417088cf5","resolution":{"observed_at":"2026-08-07T19:00:50.562995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2502.10215."}