{"as_of":"2026-08-09T18:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4372f14d8444a2144c055589895cdfe75812aedb82692e23f64a75c572e7eb9d","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T19:00:50.562995Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.10215/citation-record","integrity":"/paper/2502.10215/integrity","json":"/paper/2502.10215/citation-record.json","paper":"/paper/2502.10215"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T19:00:50.435018Z","title":", Aneja, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.435018Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:97e7369d7b224525945cd26ab30f497f1578803160c9462dc5c4a0875e8e2670","observation_id":"11d63381-a9d5-4d83-8118-98a6ef2d72f5","resolution":{"observed_at":"2026-08-07T19:00:50.435018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01425","last_updated":"2023-10-04T18:10:30Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-09-27T16:15:34Z","title":"Borges and AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01425","snapshot_observed_at":"2026-08-07T19:00:50.442007Z","title":"\\ Sch \\\"o lkopf, B","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.442007Z"},"links":{"cited_paper":"/paper/2310.01425","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:b150e858ae663c7177b1bfcbc4c9d608008a930d7831a0d72d800c2ddcfe767a","observation_id":"98940a04-d731-423c-9903-6201809434ad","resolution":{"observed_at":"2026-08-07T19:00:50.442007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:51.045886Z","title":", Lagnado, D A","venue":null,"work_id":"89cccdc5-3062-4cf6-a8f1-274f17b9c5bd","year":2015},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.446121Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:6771a28e9fd2455c1abe735331d49a9c91932efcb2cf44211a8aba50f2317f52","observation_id":"7209f95f-11d4-4fd9-bd22-142b90e9b5a3","resolution":{"observed_at":"2026-08-07T19:00:51.049606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-07T19:00:50.451001Z","title":", Chandrasekaran, V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.451001Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:cb227a911cae81c114d64b465ae12b794afa9a5897ff36f90b85ed862422b34f","observation_id":"6f4bec35-2d3d-4b8f-bdc0-0f3f8a3141e5","resolution":{"observed_at":"2026-08-07T19:00:50.451001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:51.035230Z","title":"APACrefauthors \\ 1997","venue":null,"work_id":"909ee025-5fed-4112-890e-a5bb263b5546","year":1997},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.455015Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:f692a68b569b88b1a03fdb1f9bd9aa2e6f06e540e61c9d7efd714d34457a1f10","observation_id":"3ec82d8c-ea64-41e3-a287-11c4dfc5b680","resolution":{"observed_at":"2026-08-07T19:00:51.038831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:51.021703Z","title":", Hahn, U","venue":null,"work_id":"eef6a91f-2ae7-45a5-b6a4-00baa885cf18","year":2020},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.458703Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:e00ed2b347f2ffa1245d6c4ae817aa99e3ff10c2c87bbbd455e88381afdbc258","observation_id":"036d1831-8f2f-4342-8848-4d8f8129b7fe","resolution":{"observed_at":"2026-08-07T19:00:51.026599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:51.008006Z","title":"\\ Rehder, B","venue":null,"work_id":"868a7877-cbd8-4ebb-bced-d20624465985","year":2020},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.464494Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:ac631c389e301fddba1d6fbed4821fd3798cece6e358afb649d1ab1a5a7120fc","observation_id":"c9ba285b-4db1-43cb-b4b4-ef4d516a9af1","resolution":{"observed_at":"2026-08-07T19:00:51.013175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.988141Z","title":"APACrefauthors \\ 2003","venue":null,"work_id":"ece02e87-4dfd-4598-8ce4-7bfb33b00c3f","year":2003},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.468678Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:037fa1b207357807e86b678f6c66f715302c36ec4dc6574ce9889cf26352a43e","observation_id":"1e65b964-4a3c-4dd3-938c-ff6fb2dab6e8","resolution":{"observed_at":"2026-08-07T19:00:50.993058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.472721Z","title":", Wang, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.472721Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:2b2eef2017b086837eb5cf5f0b623f1f84daf469cfdb14313832456684752195","observation_id":"239442d9-6dc2-4165-97ea-089c60368168","resolution":{"observed_at":"2026-08-07T19:00:50.472721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11050","last_updated":"2024-10-04T04:40:03Z","snapshot_observed_at":"2026-07-06T18:31:49.437336Z","submitted_at":"2024-06-16T19:22:53Z","title":"A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11050","snapshot_observed_at":"2026-08-07T19:00:50.476845Z","title":", Xie, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.476845Z"},"links":{"cited_paper":"/paper/2406.11050","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:e6fd97e23a98544ed509695032c638798c4ec81a9d095a4a7965fcfe588e5eab","observation_id":"87db11a4-e2e7-44c4-b86d-7bdc9521e13f","resolution":{"observed_at":"2026-08-07T19:00:50.476845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04350","last_updated":"2024-01-17T14:41:55Z","snapshot_observed_at":"2026-08-04T10:35:58.738226Z","submitted_at":"2023-12-07T15:12:12Z","title":"CLadder: Assessing Causal Reasoning in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04350","snapshot_observed_at":"2026-08-07T19:00:50.481238Z","title":", Chen, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.481238Z"},"links":{"cited_paper":"/paper/2312.04350","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:e3e2ee081bd3ea7f7c8fe791f42dad558648eac8d72791f9065d52b8a39009fc","observation_id":"076e1d91-30e5-48d7-9803-3032b38a02a2","resolution":{"observed_at":"2026-08-07T19:00:50.481238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.976541Z","title":"\\ Busemeyer, J R","venue":null,"work_id":"7837e50d-461b-4770-af24-91bcdb4b6ea6","year":2016},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.485606Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:93154f03f15a74077489005efad2b8c5212d1b27e35f8292c81e976817f67dff","observation_id":"27a6f6ba-4606-4446-827e-24ec14a8e4e4","resolution":{"observed_at":"2026-08-07T19:00:50.980571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.964819Z","title":"u gelgen, J. , Priesemann, V. \\ Sch \\","venue":null,"work_id":"38a1d80c-8378-452c-a46a-36069282102d","year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.489662Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:702c81a7ac528bb0c43aba8501bde3d0854059c0e7198d9846d55799e8e528e7","observation_id":"f0ab1141-f197-4b85-9c87-af5c4e0b898f","resolution":{"observed_at":"2026-08-07T19:00:50.969035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.953656Z","title":", Willig, M","venue":null,"work_id":"8442d86a-1511-4455-8c5d-63ccc9b107a2","year":2024},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.493672Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:8f9fd0bfbb632ec6ac3f39ecfb9f500135af0b38e88c2d3c957e7724ba9d5bd7","observation_id":"2f96ad58-2c7b-4852-a281-4f636dc9cde8","resolution":{"observed_at":"2026-08-07T19:00:50.957411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.00050","last_updated":"2024-08-20T17:16:20Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T19:00:43Z","title":"Causal Reasoning and Large Language Models: Opening a New Frontier for Causality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.00050","snapshot_observed_at":"2026-08-07T19:00:50.497799Z","title":", Ness, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.497799Z"},"links":{"cited_paper":"/paper/2305.00050","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:e6b44c8085f23006ae001f4998ac18f3fc6d1b709bac6f63ece67867d4828ea0","observation_id":"95048b32-d9c0-4b37-abb8-9142b27cc750","resolution":{"observed_at":"2026-08-07T19:00:50.497799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.941350Z","title":", Ullman, T D","venue":null,"work_id":"71469dce-64ff-4ad2-9abb-63b3f2e405e2","year":2017},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.503302Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:69059fe7a36cffac9dbce1bc8f87fbe0610ef948a44215b809f33a0509be6951","observation_id":"398e8bf8-2a04-4cba-ad76-40eb11529ce4","resolution":{"observed_at":"2026-08-07T19:00:50.945435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.928737Z","title":", Griffiths, T","venue":null,"work_id":"36df4d63-b0e1-4583-a6ad-11866cf9a331","year":2012},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.507719Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:6d08c0fb48081e7b217720ca68e2120feaee1e2cd9615b4ad7f825fd86d24cd4","observation_id":"97e400e8-7267-45ca-ba3a-d6a988ff0a9c","resolution":{"observed_at":"2026-08-07T19:00:50.932933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-07T19:00:50.512418Z","title":", Alizadeh, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.512418Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:e7b785edaf0ae2ecc6383219126d610bffc3f34e1de4689000f0716560ffbc28","observation_id":"ed1f2d4d-30f6-4b24-a245-c77f6151ec75","resolution":{"observed_at":"2026-08-07T19:00:50.512418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.914769Z","title":"\\ Krakauer, D C","venue":null,"work_id":"f22a8f10-2dcc-4ed4-aa1a-04e26cfe3caa","year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.517987Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:395012ac0d9e4feee982a347317ba7070d6119b4dd22b7a90481f57bec907de0","observation_id":"f13a9901-820e-4578-934b-cf2b4daea5b0","resolution":{"observed_at":"2026-08-07T19:00:50.919681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.895222Z","title":"\\ Larrick, R P","venue":null,"work_id":"b1376e9b-e946-4136-9d5c-adee20058163","year":1995},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.524427Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:26318abef96105aa15851cff03610877d235faf47ddd2c60eb127e94c17777e7","observation_id":"5c2488d4-3522-478a-b0c8-a6144950fb77","resolution":{"observed_at":"2026-08-07T19:00:50.899326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13375","last_updated":"2023-04-12T16:48:39Z","snapshot_observed_at":"2026-07-06T15:07:11.623462Z","submitted_at":"2023-03-20T16:18:38Z","title":"Capabilities of GPT-4 on Medical Challenge Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13375","snapshot_observed_at":"2026-08-07T19:00:50.529867Z","title":", King, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.529867Z"},"links":{"cited_paper":"/paper/2303.13375","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:1ec08e3f5d21a42465fb6f30ebc17e7c0b0bedc6de782f995aaa5aa45f8a64a2","observation_id":"8bb5ae64-8552-4e12-be92-87010ef827f4","resolution":{"observed_at":"2026-08-07T19:00:50.529867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.881150Z","title":"APACrefauthors \\ 2023","venue":null,"work_id":"0432f1de-3f34-4fa8-9ac5-d08bc3ec750c","year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.534513Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:700d349fdb5375b422b83ddd371d6c9d0d748bf39342c5ff9d20f946946ad809","observation_id":"7080e58b-60ef-45fc-a368-1fa4bf5c3987","resolution":{"observed_at":"2026-08-07T19:00:50.885207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.866806Z","title":"APACrefauthors \\ 1995","venue":null,"work_id":"ac5d3db5-50ff-4440-a507-25ba4710231a","year":1995},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.538411Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:f6fdef998a477541de4183548d58d346f73194ea3a5b95c257ed3d9ff63a4cba","observation_id":"cc928161-102c-4a7b-ae79-1f3a382deccd","resolution":{"observed_at":"2026-08-07T19:00:50.872267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.852135Z","title":"APACrefauthors \\ 2024","venue":null,"work_id":"1ab7862a-bf1a-4748-89ea-86ac8706f73e","year":2024},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.542781Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:eddd05fd9d14182427a069a3a349ee7baf83dd01e5c929865aba49227cd08c42","observation_id":"b9c63010-4e8a-4ff0-946a-60a4e6805a50","resolution":{"observed_at":"2026-08-07T19:00:50.856443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.838870Z","title":"\\ Waldmann, M R","venue":null,"work_id":"b2a41127-3b79-4ad2-aeec-4dcb399cdbcb","year":2017},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.546927Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:ba6649888f25080c4a5832ecd166e6594e75929cea2d3928a9651ad348369a7f","observation_id":"46e1cf7e-9d29-4b6b-862c-a6ddd0baef27","resolution":{"observed_at":"2026-08-07T19:00:50.843347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.826343Z","title":", Chen, X","venue":null,"work_id":"742d49de-2fcd-4f1c-b073-e68e2dec89ae","year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.550929Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:784b7eb552411cc433099757c0e87b0cb6f18a3f55befd453586d9b7a7207ddc","observation_id":"ee3211bf-4dc3-47b1-b940-8541d581af7d","resolution":{"observed_at":"2026-08-07T19:00:50.830296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.814618Z","title":", Goodman, N","venue":null,"work_id":"88e608ad-fd3a-45a4-86b2-32d04103a0c3","year":2014},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.554850Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:c238a5826981c85a362189f588111f9ea13351e15b138a3b82cc1868c4069e70","observation_id":"9e81dd36-293d-4d71-a7f4-ce4a9b6944d4","resolution":{"observed_at":"2026-08-07T19:00:50.818109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:00:50.802302Z","title":", Hagmayer, Y","venue":null,"work_id":"d92cee7e-3cf6-4a58-b233-725912fc56d3","year":2006},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.559003Z"},"links":{"citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:f1c23747c27f2db3d694f19db78174d4152930203d17a11ac2b6e3aff51eafb0","observation_id":"cd47205e-547f-451f-8d0a-ef7b0f5302d1","resolution":{"observed_at":"2026-08-07T19:00:50.806836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13067","last_updated":"2023-08-24T20:23:13Z","snapshot_observed_at":"2026-07-06T16:10:11.901106Z","submitted_at":"2023-08-24T20:23:13Z","title":"Causal Parrots: Large Language Models May Talk Causality But Are Not Causal","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13067","snapshot_observed_at":"2026-08-07T19:00:50.562995Z","title":", Zecevic, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T19:00:50.562995Z"},"links":{"cited_paper":"/paper/2308.13067","citing_paper":"/paper/2502.10215"},"observation_digest":"sha256:01d3b22ed9b168d34cbc056af0bac7c02e4dd031529d43b417b93eb50ced26b7","observation_id":"38ce1225-2524-4a4c-9fbc-06d417088cf5","resolution":{"observed_at":"2026-08-07T19:00:50.562995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.10215","last_updated":"2025-06-06T17:57:08Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T18:53:22.987000Z","submitted_at":"2025-02-14T15:09:15Z","title":"Do Large Language Models Reason Causally Like Us? Even Better?"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2502.10215."}