Pith. sign in

Paper Citation Record · LEDGER

Do Large Language Models Reason Causally Like Us? Even Better?

As of 10 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2502.10215.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.10215 v2

Coverage vector

measured 29 of 29 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T19:00:50.562995Z

measured 29 of 29 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

29 of 29 outbound references displayed

  • verified exact0
  • verified fuzzy19
  • unresolved10
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 11d63381-a9d5-4d83-8118-98a6ef2d72f5 · outbound

This paper cites Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone.

Do Large Language Models Reason Causally Like Us? Even Better? Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.435018Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.435018Z digest=sha256:69b6b094991759befc947d99addb03b097e24967bc3259a44ca22784e868e5a2

Observation 98940a04-d731-423c-9903-6201809434ad · outbound

This paper cites Borges and AI.

Do Large Language Models Reason Causally Like Us? Even Better? Borges and AI

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.442007Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.442007Z digest=sha256:310f47ff4d584e17628dbee0a55609566f735d97b6a805ae9e5d7b58762e8adb

Observation 7209f95f-11d4-4fd9-bd22-142b90e9b5a3 · outbound

This paper cites , Lagnado, D A.

Do Large Language Models Reason Causally Like Us? Even Better? , Lagnado, D A

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:51.049606Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.446121Z digest=sha256:ab42a3446cd3a7194265ee9c2da9e3d20296814e7bed00752157a17bdf666057

Observation 6f4bec35-2d3d-4b8f-bdc0-0f3f8a3141e5 · outbound

This paper cites Sparks of Artificial General Intelligence: Early experiments with GPT-4.

Do Large Language Models Reason Causally Like Us? Even Better? Sparks of Artificial General Intelligence: Early experiments with GPT-4

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.451001Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.451001Z digest=sha256:ca30e961e7b5f7d051c7c0f3607ffdd03bf923fcb9f8914828dde0419c2a05ea

Observation 3ec82d8c-ea64-41e3-a287-11c4dfc5b680 · outbound

This paper cites APACrefauthors \ 1997.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 1997

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:51.038831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.455015Z digest=sha256:512c12ad292b47bc35b92b27a93a447a448245ffca24235cf03f62103ad57de5

Observation 036d1831-8f2f-4342-8848-4d8f8129b7fe · outbound

This paper cites , Hahn, U.

Do Large Language Models Reason Causally Like Us? Even Better? , Hahn, U

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:51.026599Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.458703Z digest=sha256:7e1f5b934a1be749cdba893f58c73b72b2e0587bf5f59bd4f5eea8f9cd52377b

Observation c9ba285b-4db1-43cb-b4b4-ef4d516a9af1 · outbound

This paper cites \ Rehder, B.

Do Large Language Models Reason Causally Like Us? Even Better? \ Rehder, B

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:51.013175Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.464494Z digest=sha256:eafe573a392559037c28742fb9667d5ce9a09a55bc2dd70a7151641bdf1063cf

Observation 1e65b964-4a3c-4dd3-938c-ff6fb2dab6e8 · outbound

This paper cites APACrefauthors \ 2003.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 2003

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.993058Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.468678Z digest=sha256:995f4800c2dd77adc4fce291404d067fef858c35e7585233b4c8a7fe1edf5ecb

Observation 239442d9-6dc2-4165-97ea-089c60368168 · outbound

This paper cites , Wang, Z.

Do Large Language Models Reason Causally Like Us? Even Better? , Wang, Z

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.472721Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.472721Z digest=sha256:2f2b255b0b08c2a7033c725c29e33d974d5f00ed72f8246908c13fbce47a0dd0

Observation 87db11a4-e2e7-44c4-b86d-7bdc9521e13f · outbound

This paper cites A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners.

Do Large Language Models Reason Causally Like Us? Even Better? A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.476845Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.476845Z digest=sha256:012b5881e8ac5ac1f532340d0cb977231d3e1242de0e81dc6a461cdaef9d6b4b

Observation 076e1d91-30e5-48d7-9803-3032b38a02a2 · outbound

This paper cites CLadder: Assessing Causal Reasoning in Language Models.

Do Large Language Models Reason Causally Like Us? Even Better? CLadder: Assessing Causal Reasoning in Language Models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.481238Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.481238Z digest=sha256:2ae79189be4179591ee919c8372824ab9a7f0a2e3e5a9af31cb2961c27152110

Observation 27a6f6ba-4606-4446-827e-24ec14a8e4e4 · outbound

This paper cites \ Busemeyer, J R.

Do Large Language Models Reason Causally Like Us? Even Better? \ Busemeyer, J R

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.980571Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.485606Z digest=sha256:93e76dde50f5400ec6f4a1f2e126ed68c44e84c29872ef9e0c563e82a67d12ca

Observation f0ab1141-f197-4b85-9c87-af5c4e0b898f · outbound

This paper cites u gelgen, J. , Priesemann, V. \ Sch \.

Do Large Language Models Reason Causally Like Us? Even Better? u gelgen, J. , Priesemann, V. \ Sch \

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.969035Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.489662Z digest=sha256:ad911b12f2c32efd96e3ed3b978cc03fb7bffbe8e6c2085410b01b578a106755

Observation 2f96ad58-2c7b-4852-a281-4f636dc9cde8 · outbound

This paper cites , Willig, M.

Do Large Language Models Reason Causally Like Us? Even Better? , Willig, M

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.957411Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.493672Z digest=sha256:49da347b31b0c44d415b0c5b0225a4db8d5996ff954dbc0cc44429debbd42216

Observation 95048b32-d9c0-4b37-abb8-9142b27cc750 · outbound

This paper cites Causal Reasoning and Large Language Models: Opening a New Frontier for Causality.

Do Large Language Models Reason Causally Like Us? Even Better? Causal Reasoning and Large Language Models: Opening a New Frontier for Causality

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.497799Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.497799Z digest=sha256:c640b77907ba69f1e51591005dfeeb1b1b415243f8dc7563ea45e3426761e81e

Observation 398e8bf8-2a04-4cba-ad76-40eb11529ce4 · outbound

This paper cites , Ullman, T D.

Do Large Language Models Reason Causally Like Us? Even Better? , Ullman, T D

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.945435Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.503302Z digest=sha256:71805d052aba1fa253787da0694579baa9a75093d92c7aa893d39afee0befd97

Observation 97e400e8-7267-45ca-ba3a-d6a988ff0a9c · outbound

This paper cites , Griffiths, T.

Do Large Language Models Reason Causally Like Us? Even Better? , Griffiths, T

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.932933Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.507719Z digest=sha256:1ad823e6da28022a4a7ed67d29282dce58d50ef9addbca06a2284616ba300bec

Observation ed1f2d4d-30f6-4b24-a245-c77f6151ec75 · outbound

This paper cites GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models.

Do Large Language Models Reason Causally Like Us? Even Better? GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.512418Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.512418Z digest=sha256:c4cb0d251a26afe8c3a983397ebd9c194c85ec2eafd42e1f6a4ec5b0613629c3

Observation f13a9901-820e-4578-934b-cf2b4daea5b0 · outbound

This paper cites \ Krakauer, D C.

Do Large Language Models Reason Causally Like Us? Even Better? \ Krakauer, D C

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.919681Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.517987Z digest=sha256:eb9c6540fe3a56c9f525366054d77be04c1da23573bcdb6b453d58bbc4aab4ce

Observation 5c2488d4-3522-478a-b0c8-a6144950fb77 · outbound

This paper cites \ Larrick, R P.

Do Large Language Models Reason Causally Like Us? Even Better? \ Larrick, R P

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.899326Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.524427Z digest=sha256:01a4b9ffcfcc6f179d67d296932afedeb0d43b71e80472e357aafc80d7f0d890

Observation 8bb5ae64-8552-4e12-be92-87010ef827f4 · outbound

This paper cites Capabilities of GPT-4 on Medical Challenge Problems.

Do Large Language Models Reason Causally Like Us? Even Better? Capabilities of GPT-4 on Medical Challenge Problems

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.529867Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.529867Z digest=sha256:18126152e59371eebf818b3d49ff3bc531075dfa59821b30c76d27423c0d439a

Observation 7080e58b-60ef-45fc-a368-1fa4bf5c3987 · outbound

This paper cites APACrefauthors \ 2023.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 2023

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.885207Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.534513Z digest=sha256:d8f6defbe3a381db354d66da78fa08834ffde34421ff86deafe3f652ea7b3f3b

Observation cc928161-102c-4a7b-ae79-1f3a382deccd · outbound

This paper cites APACrefauthors \ 1995.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 1995

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.872267Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.538411Z digest=sha256:14bf9e834f672173a345df6fa9bbc2c3376f377aa7981a5a8ba7e9d80942e2d0

Observation b9c63010-4e8a-4ff0-946a-60a4e6805a50 · outbound

This paper cites APACrefauthors \ 2024.

Do Large Language Models Reason Causally Like Us? Even Better? APACrefauthors \ 2024

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.856443Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.542781Z digest=sha256:9096d96a76395a71eb1144ed8893911d026547116927a7541510a391b5ee8936

Observation 46e1cf7e-9d29-4b6b-862c-a6ddd0baef27 · outbound

This paper cites \ Waldmann, M R.

Do Large Language Models Reason Causally Like Us? Even Better? \ Waldmann, M R

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.843347Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.546927Z digest=sha256:85b242ab55f26055b2db1e1c49f8e5c5c3db161fae1ee0baa329116dcd8780f0

Observation ee3211bf-4dc3-47b1-b940-8541d581af7d · outbound

This paper cites , Chen, X.

Do Large Language Models Reason Causally Like Us? Even Better? , Chen, X

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.830296Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.550929Z digest=sha256:7b631cc706ff13eee5d90da3a937832b016c24f585f6348534c155a3d4ce4ca5

Observation 9e81dd36-293d-4d71-a7f4-ce4a9b6944d4 · outbound

This paper cites , Goodman, N.

Do Large Language Models Reason Causally Like Us? Even Better? , Goodman, N

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.818109Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.554850Z digest=sha256:f1dda760b123906c02483aa25ac4ced8f4dea932888d5d9555c4c21e360a488e

Observation cd47205e-547f-451f-8d0a-ef7b0f5302d1 · outbound

This paper cites , Hagmayer, Y.

Do Large Language Models Reason Causally Like Us? Even Better? , Hagmayer, Y

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T19:00:50.806836Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-08-07T19:00:50.559003Z digest=sha256:78c5fc0f202edf50d0479880a8ec192f0fa9418ca91d426406e76c55fbbc7952

Observation 38ce1225-2524-4a4c-9fbc-06d417088cf5 · outbound

This paper cites Causal Parrots: Large Language Models May Talk Causality But Are Not Causal.

Do Large Language Models Reason Causally Like Us? Even Better? Causal Parrots: Large Language Models May Talk Causality But Are Not Causal

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T19:00:50.562995Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:00:50.562995Z digest=sha256:26a6b16847eb0c7f44feec8c963e58dfd5a3c01f86a8040a6d8c8bd23edc6929

Pith citing papers

No inbound Pith citation observations are available.