Pith. sign in

Paper Citation Record · LEDGER

Do Large Language Models Reason Causally Like Us? Even Better?

As of 17 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2502.10215.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.10215 v2

Coverage vector

measured 29 of 29 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T19:00:50.562995Z

measured 29 of 29 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

29 of 29 outbound references displayed

  • verified exact0
  • verified fuzzy19
  • unresolved10
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 11d63381-a9d5-4d83-8118-98a6ef2d72f5 · outbound

This paper cites Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone.

Do Large Language Models Reason Causally Like Us? Even Better? Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.435018Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.435018Z digest=sha256:293eb26f00941a297ee05614569eacd017409d93b4467b43c973eb744c2b6ea5

Observation 98940a04-d731-423c-9903-6201809434ad · outbound

This paper cites Borges and AI.

Do Large Language Models Reason Causally Like Us? Even Better? Borges and AI

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.442007Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.442007Z digest=sha256:9c2234b4bfd2c0f229f87c8acc1c6d72f41ee4d23468b718a79b3522821b67e4

Observation 7209f95f-11d4-4fd9-bd22-142b90e9b5a3 · outbound

This paper cites , Lagnado, D A.

Do Large Language Models Reason Causally Like Us? Even Better? , Lagnado, D A

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:51.049606Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.446121Z digest=sha256:23de922bbcdfd5337c8f102aab994eee16f881b25f4c93fe8ce6226e3f1269d4

Observation 6f4bec35-2d3d-4b8f-bdc0-0f3f8a3141e5 · outbound

This paper cites Sparks of Artificial General Intelligence: Early experiments with GPT-4.

Do Large Language Models Reason Causally Like Us? Even Better? Sparks of Artificial General Intelligence: Early experiments with GPT-4

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.451001Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.451001Z digest=sha256:7acc44ef9ed3f8c05d0af98a5d814557fc0dadb51118906a61b6a2cb2fe516f0

Observation 3ec82d8c-ea64-41e3-a287-11c4dfc5b680 · outbound

This paper cites APACrefauthors \ 1997.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 1997

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:51.038831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.455015Z digest=sha256:0d39b18aead2ebf80a1989689a3c0662a3b74d162f3eb93a357a6b5db55dc96f

Observation 036d1831-8f2f-4342-8848-4d8f8129b7fe · outbound

This paper cites , Hahn, U.

Do Large Language Models Reason Causally Like Us? Even Better? , Hahn, U

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:51.026599Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.458703Z digest=sha256:a4938a00c1a0e73ac3326293841d9d39b79c6e6dc08592b33493938824c65136

Observation c9ba285b-4db1-43cb-b4b4-ef4d516a9af1 · outbound

This paper cites \ Rehder, B.

Do Large Language Models Reason Causally Like Us? Even Better? \ Rehder, B

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:51.013175Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.464494Z digest=sha256:b11abcf8407cb89b15f6325ba7f2b2ca3c4f1425ceef1ff6c5b826a2216cfbe8

Observation 1e65b964-4a3c-4dd3-938c-ff6fb2dab6e8 · outbound

This paper cites APACrefauthors \ 2003.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 2003

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.993058Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.468678Z digest=sha256:72b8eb181a6d9e8a50a2c5483fa4bcee769f3db57fc145d784c37ae3be9cb916

Observation 239442d9-6dc2-4165-97ea-089c60368168 · outbound

This paper cites , Wang, Z.

Do Large Language Models Reason Causally Like Us? Even Better? , Wang, Z

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.472721Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.472721Z digest=sha256:f8bc783832c74668db0fce6b083bc66794936bc6472d019a8aeceeb807c7588d

Observation 87db11a4-e2e7-44c4-b86d-7bdc9521e13f · outbound

This paper cites A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners.

Do Large Language Models Reason Causally Like Us? Even Better? A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.476845Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.476845Z digest=sha256:f1a4df2eb21f50794b520acdb8efcbafae273c8e7ce17d3c4294e56b27879398

Observation 076e1d91-30e5-48d7-9803-3032b38a02a2 · outbound

This paper cites CLadder: Assessing Causal Reasoning in Language Models.

Do Large Language Models Reason Causally Like Us? Even Better? CLadder: Assessing Causal Reasoning in Language Models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.481238Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.481238Z digest=sha256:a64040273db40c229126c75eab58234210edf3961385e7fcd32ccf9fbd8bbe72

Observation 27a6f6ba-4606-4446-827e-24ec14a8e4e4 · outbound

This paper cites \ Busemeyer, J R.

Do Large Language Models Reason Causally Like Us? Even Better? \ Busemeyer, J R

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.980571Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.485606Z digest=sha256:4de20fe37185bbdd168022a65038dd3a8cf494e613a125b0e9eb56734fa8d7d7

Observation f0ab1141-f197-4b85-9c87-af5c4e0b898f · outbound

This paper cites u gelgen, J. , Priesemann, V. \ Sch \.

Do Large Language Models Reason Causally Like Us? Even Better? u gelgen, J. , Priesemann, V. \ Sch \

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.969035Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.489662Z digest=sha256:98344920714bdf707e8efc1108192b0857b8b975e6b864cc6bf84764fe2bf7c6

Observation 2f96ad58-2c7b-4852-a281-4f636dc9cde8 · outbound

This paper cites , Willig, M.

Do Large Language Models Reason Causally Like Us? Even Better? , Willig, M

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.957411Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.493672Z digest=sha256:d064310cc903f31eb07376a900aaef5b2839c5626eae1ead10d3c976a21fab26

Observation 95048b32-d9c0-4b37-abb8-9142b27cc750 · outbound

This paper cites Causal Reasoning and Large Language Models: Opening a New Frontier for Causality.

Do Large Language Models Reason Causally Like Us? Even Better? Causal Reasoning and Large Language Models: Opening a New Frontier for Causality

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.497799Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.497799Z digest=sha256:7e4595ada2661cc87554d7ab816ff73a12459185a87b594ebf67bc4b3c9d355d

Observation 398e8bf8-2a04-4cba-ad76-40eb11529ce4 · outbound

This paper cites , Ullman, T D.

Do Large Language Models Reason Causally Like Us? Even Better? , Ullman, T D

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.945435Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.503302Z digest=sha256:7891ef584d5b644acf1c28eee3c618bd6f8e1de34b8fcc0f1fdeae3c77552a13

Observation 97e400e8-7267-45ca-ba3a-d6a988ff0a9c · outbound

This paper cites , Griffiths, T.

Do Large Language Models Reason Causally Like Us? Even Better? , Griffiths, T

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.932933Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.507719Z digest=sha256:1cbf4415b1a0c3ba107678f96686a64edd047a37b76176af11cc35c700079f3e

Observation ed1f2d4d-30f6-4b24-a245-c77f6151ec75 · outbound

This paper cites GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models.

Do Large Language Models Reason Causally Like Us? Even Better? GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.512418Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.512418Z digest=sha256:c9b7fdbd15353da2aa912ce42b618cd9368cc4a26234b8b2a499e3f894b32d59

Observation f13a9901-820e-4578-934b-cf2b4daea5b0 · outbound

This paper cites \ Krakauer, D C.

Do Large Language Models Reason Causally Like Us? Even Better? \ Krakauer, D C

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.919681Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.517987Z digest=sha256:0d596c477f6a00c3f983a5d8d55d178a1a51245ff9b5b57e450b19a56887e947

Observation 5c2488d4-3522-478a-b0c8-a6144950fb77 · outbound

This paper cites \ Larrick, R P.

Do Large Language Models Reason Causally Like Us? Even Better? \ Larrick, R P

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.899326Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.524427Z digest=sha256:0e5dbae69bdff58de8b5dc43b0280ab4f626372d2b0c4cfda965b535207aeaab

Observation 8bb5ae64-8552-4e12-be92-87010ef827f4 · outbound

This paper cites Capabilities of GPT-4 on Medical Challenge Problems.

Do Large Language Models Reason Causally Like Us? Even Better? Capabilities of GPT-4 on Medical Challenge Problems

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.529867Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.529867Z digest=sha256:39b4bee3a1a012895945ab8275c74789d8134a9cec372e2a57fa07c9f911788d

Observation 7080e58b-60ef-45fc-a368-1fa4bf5c3987 · outbound

This paper cites APACrefauthors \ 2023.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 2023

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.885207Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.534513Z digest=sha256:78fc253282097be0d7f2e1a0f7d4cf1128d1d28f983150de739640dc89a2b9f6

Observation cc928161-102c-4a7b-ae79-1f3a382deccd · outbound

This paper cites APACrefauthors \ 1995.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 1995

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.872267Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.538411Z digest=sha256:1815278503f0c348e516d3ecb46ea7366d21f5d42ba52ede3ad1292df205f329

Observation b9c63010-4e8a-4ff0-946a-60a4e6805a50 · outbound

This paper cites APACrefauthors \ 2024.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 2024

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.856443Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.542781Z digest=sha256:40a58e18cf3306d0af752aa9e488cce5a895d95654ec1f7968b7939c217cdd2c

Observation 46e1cf7e-9d29-4b6b-862c-a6ddd0baef27 · outbound

This paper cites \ Waldmann, M R.

Do Large Language Models Reason Causally Like Us? Even Better? \ Waldmann, M R

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.843347Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.546927Z digest=sha256:7089ea2d8afd7f847001b6fe5e782dd53d51196e61cac56bd832283f1c101d8b

Observation ee3211bf-4dc3-47b1-b940-8541d581af7d · outbound

This paper cites , Chen, X.

Do Large Language Models Reason Causally Like Us? Even Better? , Chen, X

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.830296Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.550929Z digest=sha256:130b54b7923b379a3d45a99af0d1729b9d23a0439ca11e2f7df59ce35a8ef412

Observation 9e81dd36-293d-4d71-a7f4-ce4a9b6944d4 · outbound

This paper cites , Goodman, N.

Do Large Language Models Reason Causally Like Us? Even Better? , Goodman, N

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.818109Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.554850Z digest=sha256:830804c12e70da0f9cd1abcf82e9bd1f0fbcd412ad1c8f403ceee61d791b9c3d

Observation cd47205e-547f-451f-8d0a-ef7b0f5302d1 · outbound

This paper cites , Hagmayer, Y.

Do Large Language Models Reason Causally Like Us? Even Better? , Hagmayer, Y

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.806836Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.559003Z digest=sha256:8f9fd4074f208227021a740caf4d52dac064ee15add395669250fc15356a30e1

Observation 38ce1225-2524-4a4c-9fbc-06d417088cf5 · outbound

This paper cites Causal Parrots: Large Language Models May Talk Causality But Are Not Causal.

Do Large Language Models Reason Causally Like Us? Even Better? Causal Parrots: Large Language Models May Talk Causality But Are Not Causal

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.562995Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.562995Z digest=sha256:56a937919ba8811ec2d1d847f55f8c438efe9f72aa7e6edc8e82f5015fa75974

Pith citing papers

No inbound Pith citation observations are available.