{"as_of":"2026-08-09T19:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:579b62069a985417d2ef978507268352a22149df11be10ab7dabea1e38d15c9c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T15:26:07.791076Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":18,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2402.09664","last_updated":"2026-04-07T05:36:18Z","snapshot_observed_at":"2026-07-06T17:30:25.359458Z","submitted_at":"2024-02-15T02:24:46Z","title":"CodeMind: Evaluating Large Language Models for Code Reasoning","version":6},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-24T03:53:55.964755Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2402.09664"},"observation_digest":"sha256:8ade2e291a10643d259714f749c5a1e4c365b017d2be1e0d4cde0a027ce0390b","observation_id":"bc2dccdf-d5c3-42fd-9e58-6dd7403b02ab","resolution":{"observed_at":"2026-05-24T03:55:59.724114Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-10T17:34:42.565806Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2403.07974"},"observation_digest":"sha256:3eb903b36c7ba15b1d1795a58c3b534dc6b440e734553a96ca067ecbb44015e7","observation_id":"62556a23-cace-46bc-8bd7-288500d2566c","resolution":{"observed_at":"2026-05-10T17:34:43.061781Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-08T15:26:07.791076Z","title":"Reasoning or reciting? ex- ploring the capabilities and limitations of language models through counterfactual tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06453","last_updated":"2025-02-12T23:16:27Z","snapshot_observed_at":"2026-08-08T15:20:43.084873Z","submitted_at":"2025-02-10T13:31:46Z","title":"MATH-Perturb: Benchmarking LLMs' Math Reasoning Abilities against Hard Perturbations","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T15:26:07.791076Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2502.06453"},"observation_digest":"sha256:f844eee4136c642af5ec0c1ee9dda7bc6f3b793f5bfd82332ca52fd3af443351","observation_id":"72d5a5a4-9e23-4837-bf1d-6761112bb72a","resolution":{"observed_at":"2026-08-08T15:26:07.791076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-07T22:12:50.234654Z","title":"Reasoning or reciting? Exploring the capabilities and limitations of language models through counterfactual tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09297","last_updated":"2025-09-09T07:21:48Z","snapshot_observed_at":"2026-08-08T05:23:52.374410Z","submitted_at":"2025-02-13T13:11:54Z","title":"When Do Neural Networks Learn World Models?","version":5},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-07T22:12:50.234654Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2502.09297"},"observation_digest":"sha256:db7a6e818339f82ca7ce6c061418f15037710f4ed66d3a100d71c85dc5a9ffa8","observation_id":"7c070b59-3f4c-41e0-b02b-0124c0af69c5","resolution":{"observed_at":"2026-08-07T22:12:50.234654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-07T12:35:12.114973Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24173","last_updated":"2025-05-30T03:33:25Z","snapshot_observed_at":"2026-08-07T20:54:16.475143Z","submitted_at":"2025-05-30T03:33:25Z","title":"DrVD-Bench: Do Vision-Language Models Reason Like Human Doctors in Medical Image Diagnosis?","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:12.114973Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2505.24173"},"observation_digest":"sha256:50aba32d983c05c6d7aa3a649af146feb62d87b10ce1a0a8204c880bb7cebe14","observation_id":"bb29bb42-4472-487b-8b80-686ea9d74086","resolution":{"observed_at":"2026-08-07T12:35:12.114973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-06T22:36:25.165193Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks.arXiv preprint arXiv:2307.02477, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21215","last_updated":"2025-06-26T13:11:01Z","snapshot_observed_at":"2026-08-09T13:41:52.238649Z","submitted_at":"2025-06-26T13:11:01Z","title":"Unveiling Causal Reasoning in Large Language Models: Reality or Mirage?","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T22:36:25.165193Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2506.21215"},"observation_digest":"sha256:bdb2518783258b137ae3f009a8a251698338a1259e3a24bbbded528262a6a80e","observation_id":"348c9fc5-24dc-48f0-9148-e211ba1f9b8c","resolution":{"observed_at":"2026-08-06T22:36:25.165193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2510.15079","last_updated":"2026-04-07T05:37:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T18:48:12Z","title":"Assessing Coherency and Consistency of Code Execution Reasoning by Large Language Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-18T05:59:00.400429Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2510.15079"},"observation_digest":"sha256:eaeb6d9d1989e035e6e428d21ed6abf147e4c960de6d063fe7983e23ce4393d5","observation_id":"0f37452d-96db-4374-a55d-dd9ebd2a7fa8","resolution":{"observed_at":"2026-05-18T06:00:57.202752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2604.13934","last_updated":"2026-04-15T14:46:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-15T14:46:12Z","title":"Towards Enabling An Artificial Self-Construction Software Life-cycle via Autopoietic Architectures","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-10T12:43:14.903173Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2604.13934"},"observation_digest":"sha256:63b3467b03c40c9ad64b5278f6e31118f8a6f5aa8407cf492486505745ac93a9","observation_id":"934dde8a-37b4-41c8-8e43-43025358ee8d","resolution":{"observed_at":"2026-05-10T12:45:23.463395Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2605.07307","last_updated":"2026-05-08T06:15:50Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:15:50Z","title":"Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-11T02:11:19.295354Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2605.07307"},"observation_digest":"sha256:f7b153bc1a0e6d2e890a5fd14908f34119a99f00099a3b15479ee07fd36e4865","observation_id":"6f1e6424-c511-461c-b745-9f61eaa03f69","resolution":{"observed_at":"2026-05-11T03:50:57.407403Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2606.02211","last_updated":"2026-06-01T13:10:49Z","snapshot_observed_at":"2026-08-02T18:41:16.377453Z","submitted_at":"2026-06-01T13:10:49Z","title":"Consistency Training while Mitigating Obfuscation via Rate Matching","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:43.147442Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2606.02211"},"observation_digest":"sha256:78007d08c9332fdbbcb5170b95e413cb8e2cd78e5a72cb57fb376707dde0fe05","observation_id":"5fa8a140-b3c5-4625-b317-12fc078b4972","resolution":{"observed_at":"2026-06-28T14:32:18.024087Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2606.08068","last_updated":"2026-07-08T15:21:39Z","snapshot_observed_at":"2026-07-12T14:47:31.355938Z","submitted_at":"2026-06-06T09:33:32Z","title":"DICE: Entropy-Regularized Equilibrium Selection for Stable Multi-Agent LLM Coordination","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-06-27T19:58:32.016341Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2606.08068"},"observation_digest":"sha256:754da6e238ce77ea2d55ab6eedd7ec42fb41cf8b39fce52b29e5b010885d6a8d","observation_id":"6ef97197-df16-45ad-a0e0-1cd392c09bb8","resolution":{"observed_at":"2026-07-02T20:57:23.994598Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2606.29799","last_updated":"2026-06-29T05:27:09Z","snapshot_observed_at":"2026-07-07T00:03:45.783349Z","submitted_at":"2026-06-29T05:27:09Z","title":"The CRISTAL Method: Neurosymbolic analysis from AI-synthesized world models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T06:40:40.776789Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2606.29799"},"observation_digest":"sha256:a50323d875caada68a90bb649d04c9d95b69d85083e64dd97cc9a6b6cdc40a24","observation_id":"1733969a-8cd5-4930-9094-42d7c728d6de","resolution":{"observed_at":"2026-06-30T06:44:18.978102Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2607.00276","last_updated":"2026-06-30T23:52:15Z","snapshot_observed_at":"2026-08-09T09:31:38.270841Z","submitted_at":"2026-06-30T23:52:15Z","title":"Testing Frontier Large Language Models' Physics Literacy in Parallel Physical Worlds","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-02T19:18:43.558804Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2607.00276"},"observation_digest":"sha256:01d55347f71fe9846b5a92f8071243d60ebc2dea90b49e5f67bb78316b62c6ef","observation_id":"f43aec6a-2efa-4036-9afe-fa959a6a4af9","resolution":{"observed_at":"2026-07-02T19:27:18.684825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2307.02477/citation-record","integrity":"/paper/2307.02477/integrity","json":"/paper/2307.02477/citation-record.json","paper":"/paper/2307.02477"},"outbound":[],"paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2307.02477."}