Pith. sign in

Paper Citation Record · LEDGER

Do Large Language Models Reason Causally Like Us? Even Better?

As of 8 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2502.10215.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.10215 v2

Coverage vector

measured 29 of 29 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T19:00:50.562995Z

measured 29 of 29 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

29 of 29 outbound references displayed

  • verified exact0
  • verified fuzzy19
  • unresolved10
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 11d63381-a9d5-4d83-8118-98a6ef2d72f5 · outbound

This paper cites Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone.

Do Large Language Models Reason Causally Like Us? Even Better? Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.435018Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.435018Z digest=sha256:97e7369d7b224525945cd26ab30f497f1578803160c9462dc5c4a0875e8e2670

Observation 98940a04-d731-423c-9903-6201809434ad · outbound

This paper cites Borges and AI.

Do Large Language Models Reason Causally Like Us? Even Better? Borges and AI

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.442007Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.442007Z digest=sha256:b150e858ae663c7177b1bfcbc4c9d608008a930d7831a0d72d800c2ddcfe767a

Observation 7209f95f-11d4-4fd9-bd22-142b90e9b5a3 · outbound

This paper cites , Lagnado, D A.

Do Large Language Models Reason Causally Like Us? Even Better? , Lagnado, D A

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:51.049606Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.446121Z digest=sha256:14b0b1d98e9a5cb260cd16ba18e17fe286d1853c19e3da27877108eeae013c3d

Observation 6f4bec35-2d3d-4b8f-bdc0-0f3f8a3141e5 · outbound

This paper cites Sparks of Artificial General Intelligence: Early experiments with GPT-4.

Do Large Language Models Reason Causally Like Us? Even Better? Sparks of Artificial General Intelligence: Early experiments with GPT-4

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.451001Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.451001Z digest=sha256:cb227a911cae81c114d64b465ae12b794afa9a5897ff36f90b85ed862422b34f

Observation 3ec82d8c-ea64-41e3-a287-11c4dfc5b680 · outbound

This paper cites APACrefauthors \ 1997.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 1997

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:51.038831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.455015Z digest=sha256:c75b5889a58ce0c4cc33f2a16a2c341038536c7d72e95d5bf667ea302a605941

Observation 036d1831-8f2f-4342-8848-4d8f8129b7fe · outbound

This paper cites , Hahn, U.

Do Large Language Models Reason Causally Like Us? Even Better? , Hahn, U

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:51.026599Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.458703Z digest=sha256:a7c896594bcca70d2266a4aa2862ccee83dda095a2210a18a6cd1617a1f98311

Observation c9ba285b-4db1-43cb-b4b4-ef4d516a9af1 · outbound

This paper cites \ Rehder, B.

Do Large Language Models Reason Causally Like Us? Even Better? \ Rehder, B

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:51.013175Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.464494Z digest=sha256:4a98566b7fb6b80e3a64b6a92ad2d8670c56c0171b6f6cfad03f755f4c11bf84

Observation 1e65b964-4a3c-4dd3-938c-ff6fb2dab6e8 · outbound

This paper cites APACrefauthors \ 2003.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 2003

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.993058Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.468678Z digest=sha256:22b7741787caf0d7ca9cfecce1fbd894ad7cb82beee45cf9035fdecc4fb09498

Observation 239442d9-6dc2-4165-97ea-089c60368168 · outbound

This paper cites , Wang, Z.

Do Large Language Models Reason Causally Like Us? Even Better? , Wang, Z

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.472721Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.472721Z digest=sha256:2b2eef2017b086837eb5cf5f0b623f1f84daf469cfdb14313832456684752195

Observation 87db11a4-e2e7-44c4-b86d-7bdc9521e13f · outbound

This paper cites A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners.

Do Large Language Models Reason Causally Like Us? Even Better? A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.476845Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.476845Z digest=sha256:e6fd97e23a98544ed509695032c638798c4ec81a9d095a4a7965fcfe588e5eab

Observation 076e1d91-30e5-48d7-9803-3032b38a02a2 · outbound

This paper cites CLadder: Assessing Causal Reasoning in Language Models.

Do Large Language Models Reason Causally Like Us? Even Better? CLadder: Assessing Causal Reasoning in Language Models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.481238Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.481238Z digest=sha256:e3e2ee081bd3ea7f7c8fe791f42dad558648eac8d72791f9065d52b8a39009fc

Observation 27a6f6ba-4606-4446-827e-24ec14a8e4e4 · outbound

This paper cites \ Busemeyer, J R.

Do Large Language Models Reason Causally Like Us? Even Better? \ Busemeyer, J R

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.980571Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.485606Z digest=sha256:8bd02c200fcc1f6188a09045c2d4b5b8a169b99d2f46bffd99cf8a90dab8df2f

Observation f0ab1141-f197-4b85-9c87-af5c4e0b898f · outbound

This paper cites u gelgen, J. , Priesemann, V. \ Sch \.

Do Large Language Models Reason Causally Like Us? Even Better? u gelgen, J. , Priesemann, V. \ Sch \

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.969035Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.489662Z digest=sha256:215d112f8bd4d466bdc73dbb5524a1c02de38b0b1d184e60f8b8c61e6a5dc821

Observation 2f96ad58-2c7b-4852-a281-4f636dc9cde8 · outbound

This paper cites , Willig, M.

Do Large Language Models Reason Causally Like Us? Even Better? , Willig, M

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.957411Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.493672Z digest=sha256:dfd2dde5194445ae55fa3d01dbc94961e72e554192a4ff11737917746ca686ca

Observation 95048b32-d9c0-4b37-abb8-9142b27cc750 · outbound

This paper cites Causal Reasoning and Large Language Models: Opening a New Frontier for Causality.

Do Large Language Models Reason Causally Like Us? Even Better? Causal Reasoning and Large Language Models: Opening a New Frontier for Causality

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.497799Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.497799Z digest=sha256:e6b44c8085f23006ae001f4998ac18f3fc6d1b709bac6f63ece67867d4828ea0

Observation 398e8bf8-2a04-4cba-ad76-40eb11529ce4 · outbound

This paper cites , Ullman, T D.

Do Large Language Models Reason Causally Like Us? Even Better? , Ullman, T D

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.945435Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.503302Z digest=sha256:28c71425330438e7be926269ae290be891ecb6fcc479a3a387ae63c1018300e5

Observation 97e400e8-7267-45ca-ba3a-d6a988ff0a9c · outbound

This paper cites , Griffiths, T.

Do Large Language Models Reason Causally Like Us? Even Better? , Griffiths, T

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.932933Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.507719Z digest=sha256:7545f3986baa085ff88e2dcae54902e8db377e81904ab844e32af3b9c52ce404

Observation ed1f2d4d-30f6-4b24-a245-c77f6151ec75 · outbound

This paper cites GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models.

Do Large Language Models Reason Causally Like Us? Even Better? GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.512418Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.512418Z digest=sha256:e7b785edaf0ae2ecc6383219126d610bffc3f34e1de4689000f0716560ffbc28

Observation f13a9901-820e-4578-934b-cf2b4daea5b0 · outbound

This paper cites \ Krakauer, D C.

Do Large Language Models Reason Causally Like Us? Even Better? \ Krakauer, D C

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.919681Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.517987Z digest=sha256:d37767ba3d721d717e7913f4200f9338d1826e468f9e038a3189fda19e4b2c18

Observation 5c2488d4-3522-478a-b0c8-a6144950fb77 · outbound

This paper cites \ Larrick, R P.

Do Large Language Models Reason Causally Like Us? Even Better? \ Larrick, R P

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.899326Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.524427Z digest=sha256:03ece00eb05cd9eb36df057138945e702324d7927278cbebd174d3578edaefad

Observation 8bb5ae64-8552-4e12-be92-87010ef827f4 · outbound

This paper cites Capabilities of GPT-4 on Medical Challenge Problems.

Do Large Language Models Reason Causally Like Us? Even Better? Capabilities of GPT-4 on Medical Challenge Problems

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.529867Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.529867Z digest=sha256:1ec08e3f5d21a42465fb6f30ebc17e7c0b0bedc6de782f995aaa5aa45f8a64a2

Observation 7080e58b-60ef-45fc-a368-1fa4bf5c3987 · outbound

This paper cites APACrefauthors \ 2023.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 2023

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.885207Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.534513Z digest=sha256:535b8441861d971af8eae4ccdf08c0606c1aa5ad3b2706feb3dcad7608087dfc

Observation cc928161-102c-4a7b-ae79-1f3a382deccd · outbound

This paper cites APACrefauthors \ 1995.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 1995

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.872267Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.538411Z digest=sha256:cea29bfeb91d39abc7a3c891bd291661b50ab9a58156c871010b42153ced7c65

Observation b9c63010-4e8a-4ff0-946a-60a4e6805a50 · outbound

This paper cites APACrefauthors \ 2024.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 2024

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.856443Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.542781Z digest=sha256:e0c69d694157aa2ab66dab490eaa23d56502d0bb9cfbf1ffc8f469d09d38d64f

Observation 46e1cf7e-9d29-4b6b-862c-a6ddd0baef27 · outbound

This paper cites \ Waldmann, M R.

Do Large Language Models Reason Causally Like Us? Even Better? \ Waldmann, M R

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.843347Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.546927Z digest=sha256:5707d1483d17e36729398a4db4662cd88a141906aeea86bf796bfdad91e85c5b

Observation ee3211bf-4dc3-47b1-b940-8541d581af7d · outbound

This paper cites , Chen, X.

Do Large Language Models Reason Causally Like Us? Even Better? , Chen, X

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.830296Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.550929Z digest=sha256:ea1aa638340788a8dae8236af4e30311bcc21d66f6dd274fc9f2bd987b6c5c90

Observation 9e81dd36-293d-4d71-a7f4-ce4a9b6944d4 · outbound

This paper cites , Goodman, N.

Do Large Language Models Reason Causally Like Us? Even Better? , Goodman, N

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.818109Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.554850Z digest=sha256:f71d5b1d348fcbd1d99fb9de15cd89c5c1ffeb1a6ce3bb0547249b44337e5779

Observation cd47205e-547f-451f-8d0a-ef7b0f5302d1 · outbound

This paper cites , Hagmayer, Y.

Do Large Language Models Reason Causally Like Us? Even Better? , Hagmayer, Y

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.806836Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.559003Z digest=sha256:dd2edcd0e1cf5029a1f380b6d795a84c4114d13c9c05617f85c011950736bcc8

Observation 38ce1225-2524-4a4c-9fbc-06d417088cf5 · outbound

This paper cites Causal Parrots: Large Language Models May Talk Causality But Are Not Causal.

Do Large Language Models Reason Causally Like Us? Even Better? Causal Parrots: Large Language Models May Talk Causality But Are Not Causal

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.562995Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.562995Z digest=sha256:01d3b22ed9b168d34cbc056af0bac7c02e4dd031529d43b417b93eb50ced26b7

Pith citing papers

No inbound Pith citation observations are available.