{"as_of":"2026-08-09T23:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9656f79810afd41cfcdf3f54914e697536ed34f2da9de7c6558abe0acfafe97a","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T04:32:43.097070Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T05:00:57.031724Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-24T03:55:59.589522Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"cited_work":{"arxiv_id":"2502.03568","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03568","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Code simulation as a proxy for high-order tasks in large language models","venue":null,"work_id":"4daa3f10-92d1-490f-bd32-312b99db2d8e","year":2025},"citing_paper":{"arxiv_id":"2402.09664","last_updated":"2026-04-07T05:36:18Z","snapshot_observed_at":"2026-07-06T17:30:25.359458Z","submitted_at":"2024-02-15T02:24:46Z","title":"CodeMind: Evaluating Large Language Models for Code Reasoning","version":6},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-24T03:53:55.964755Z"},"links":{"cited_paper":"/paper/2502.03568","citing_paper":"/paper/2402.09664"},"observation_digest":"sha256:9feb69a2e7370579c4182eca2e00dea3cf1d3db561250480a01f2a9e10b82cb3","observation_id":"676a4fc0-84d7-407f-afdf-1f30d299d6b4","resolution":{"observed_at":"2026-05-24T03:55:59.595643Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"cited_work":{"arxiv_id":"2502.03568","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03568","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Code simulation as a proxy for high-order tasks in large language models","venue":null,"work_id":"4daa3f10-92d1-490f-bd32-312b99db2d8e","year":2025},"citing_paper":{"arxiv_id":"2512.14917","last_updated":"2026-04-23T22:42:11Z","snapshot_observed_at":"2026-07-31T07:00:51.587326Z","submitted_at":"2025-12-16T21:12:53Z","title":"Evaluating Code Reasoning Abilities of Large Language Models Under Real-World Settings","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T21:23:44.762007Z"},"links":{"cited_paper":"/paper/2502.03568","citing_paper":"/paper/2512.14917"},"observation_digest":"sha256:b270fb5cec3fc3e346d9a50db6f5be7d1a2259c038ce3576589ccc96de6e1add","observation_id":"cff4e69c-bcbc-4603-8637-9a65923ef504","resolution":{"observed_at":"2026-05-16T21:28:34.263000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03568","snapshot_observed_at":"2026-08-03T05:00:57.031724Z","title":"A., Marro, S., Cohn, A., Shadbolt, N., and Wooldridge, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.03542","last_updated":"2026-06-03T16:48:57Z","snapshot_observed_at":"2026-08-09T19:48:29.082681Z","submitted_at":"2026-02-03T13:56:54Z","title":"Can Large Language Models Generalize Procedures Across Representations?","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-03T05:00:57.031724Z"},"links":{"cited_paper":"/paper/2502.03568","citing_paper":"/paper/2602.03542"},"observation_digest":"sha256:02efc6fd17fe2341121f0f67bf7a4db061e08d1ba16e47cc6b8045970ec95019","observation_id":"c0ff19a9-f360-42b1-a935-dfc230cb54f7","resolution":{"observed_at":"2026-08-03T05:00:57.031724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"cited_work":{"arxiv_id":"2502.03568","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03568","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Code simulation as a proxy for high-order tasks in large language models","venue":null,"work_id":"4daa3f10-92d1-490f-bd32-312b99db2d8e","year":2025},"citing_paper":{"arxiv_id":"2604.08816","last_updated":"2026-04-09T23:11:28Z","snapshot_observed_at":"2026-07-06T22:57:50.266735Z","submitted_at":"2026-04-09T23:11:28Z","title":"Loom: A Scalable Analytical Neural Computer Architecture","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T17:01:33.381684Z"},"links":{"cited_paper":"/paper/2502.03568","citing_paper":"/paper/2604.08816"},"observation_digest":"sha256:83b423248e1b87e071df6cc100577286af3fdaf278735a188b79bd4fe51a73b9","observation_id":"4af4f324-9f70-4206-94ae-b9b6fde9eabc","resolution":{"observed_at":"2026-05-11T07:41:01.341436Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.03568/citation-record","integrity":"/paper/2502.03568/integrity","json":"/paper/2502.03568/citation-record.json","paper":"/paper/2502.03568"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:42.053524Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.053524Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:d38b7b11312791f15707a185d27281c067bbb4bda712e16124d0ca0bab83bcf3","observation_id":"650efc5d-efb3-4474-bb3d-256194110928","resolution":{"observed_at":"2026-08-09T04:32:42.053524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12288","last_updated":"2024-05-26T17:45:21Z","snapshot_observed_at":"2026-08-08T21:15:49.602751Z","submitted_at":"2023-09-21T17:52:19Z","title":"The Reversal Curse: LLMs trained on \"A is B\" fail to learn \"B is A\"","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12288","snapshot_observed_at":"2026-08-09T04:32:42.074036Z","title":"a is b\" fail to learn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.074036Z"},"links":{"cited_paper":"/paper/2309.12288","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:4630130e205b068fc63369c7271f574f54669ab5d2ae10963f1bde05ff13b672","observation_id":"c20a1d16-5d80-479f-9d9d-988d67d7bd85","resolution":{"observed_at":"2026-08-09T04:32:42.074036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11158","last_updated":"2023-05-31T19:09:45Z","snapshot_observed_at":"2026-08-09T18:50:48.517398Z","submitted_at":"2023-04-21T17:58:31Z","title":"Emergent and Predictable Memorization in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11158","snapshot_observed_at":"2026-08-09T04:32:42.090876Z","title":"S., Sutawika, L., Schoelkopf, H., Anthony, Q., Purohit, S., and Raf, E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.090876Z"},"links":{"cited_paper":"/paper/2304.11158","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:e877e2da875b657c93bddfe007f5853b207155b57d20434f5740a333fc331237","observation_id":"386b360c-cbb1-44f6-9413-8cd6bf6e658a","resolution":{"observed_at":"2026-08-09T04:32:42.090876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.842621Z","title":"Evaluating large language models with runtime behavior of program execution, 2024 a","venue":null,"work_id":"cd411b3f-ca45-4a97-8af2-6621e605127d","year":2024},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.109854Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:c662c4e215a79a4e4631b081abfb18c4a73a5f17c758555d049cda914f6db1f5","observation_id":"efad35fd-d604-4f8d-b04d-b9c6c8dba6b7","resolution":{"observed_at":"2026-08-09T04:32:43.845654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.834120Z","title":"Can language models pretend solvers? logic code simulation with llms, 2024 b","venue":null,"work_id":"80a79140-d680-484a-921b-ac105f1c00bf","year":2024},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.115158Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:66b0ec8a32f60c8c0c38c6f2862e0775c7de9fabfaf21db265c3e5b28cbd2fe8","observation_id":"96667ce8-49da-42d5-9c4d-b254e28aebd2","resolution":{"observed_at":"2026-08-09T04:32:43.837199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-09T04:32:42.134673Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.134673Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:2664b436523b513b115177c4c9a1cd191099c74cab0f9239638e455336b0d8ac","observation_id":"67e499d6-69b7-408e-802d-582611f8b171","resolution":{"observed_at":"2026-08-09T04:32:42.134673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.825472Z","title":"Position information in transformers: An overview","venue":null,"work_id":"824e4ffc-485a-490c-9960-8e30fcf1a36e","year":2022},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.155109Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:a6ad96cda621bafb6e614ed451da367081449fe84414e6f68b657c011db17166","observation_id":"d5a3c78c-456e-476a-96e0-17fef2eef4df","resolution":{"observed_at":"2026-08-09T04:32:43.828689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18654","last_updated":"2023-10-31T16:35:07Z","snapshot_observed_at":"2026-08-06T15:30:28.043264Z","submitted_at":"2023-05-29T23:24:14Z","title":"Faith and Fate: Limits of Transformers on Compositionality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18654","snapshot_observed_at":"2026-08-09T04:32:42.169844Z","title":"L., Jian, L., Lin, B","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.169844Z"},"links":{"cited_paper":"/paper/2305.18654","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:7c453d88bfe254a9348d844f8961f990d6dc21ef0b6a529d74b0d30cb9dd49e2","observation_id":"fdcc3fd7-c22e-4c65-9b37-6fc1dc373dce","resolution":{"observed_at":"2026-08-09T04:32:42.169844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02238","last_updated":"2023-10-04T05:20:19Z","snapshot_observed_at":"2026-08-06T15:19:35.944642Z","submitted_at":"2023-10-03T17:48:14Z","title":"Who's Harry Potter? Approximate Unlearning in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02238","snapshot_observed_at":"2026-08-09T04:32:42.198520Z","title":"and Russinovich, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.198520Z"},"links":{"cited_paper":"/paper/2310.02238","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:ca9bfc7b9b50da4823580baab7825921fe3321ed533c0e1e161ab4d79b8777cd","observation_id":"e8c35643-e71d-4213-8334-eb6811ec4146","resolution":{"observed_at":"2026-08-09T04:32:42.198520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13867","last_updated":"2023-07-20T17:59:14Z","snapshot_observed_at":"2026-08-09T06:38:26.345241Z","submitted_at":"2023-01-31T18:59:03Z","title":"Mathematical Capabilities of ChatGPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13867","snapshot_observed_at":"2026-08-09T04:32:42.216619Z","title":"C., and Berner, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.216619Z"},"links":{"cited_paper":"/paper/2301.13867","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:a29d965cbbb4a7ca225c4356b40ccc53cd885c7028ab1a388ed03b8fc459a69e","observation_id":"6411cf81-1f8d-41b7-84f9-2e3ff147d37e","resolution":{"observed_at":"2026-08-09T04:32:42.216619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-09T04:32:42.237291Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.237291Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:42e5b3b5f29da9973af9789b91663499476cc9315a027af9b39f5d1913c3cc2c","observation_id":"b2205962-041d-4986-a803-69a053fa86ff","resolution":{"observed_at":"2026-08-09T04:32:42.237291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13196","last_updated":"2023-01-30T18:57:31Z","snapshot_observed_at":"2026-07-06T14:46:15.598295Z","submitted_at":"2023-01-30T18:57:31Z","title":"Looped Transformers as Programmable Computers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13196","snapshot_observed_at":"2026-08-09T04:32:42.264753Z","title":"D., and Papailiopoulos, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.264753Z"},"links":{"cited_paper":"/paper/2301.13196","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:47794979858b4272bbb1203b0073c2c09fc686ea5b234babe281e5fecb95833c","observation_id":"28546185-d62e-4537-a937-0b376b7029c8","resolution":{"observed_at":"2026-08-09T04:32:42.264753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-09T04:32:42.276216Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.276216Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:0ec9096a76cc1a2a809ab23772ce4a15b4e71adca395fc0465acd111d77c1fb2","observation_id":"ee6c40a6-a60c-4467-9ad4-270a530ea4d4","resolution":{"observed_at":"2026-08-09T04:32:42.276216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.816280Z","title":null,"venue":null,"work_id":"449954ab-eb57-4c35-91d4-35725dffa7c6","year":2024},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.280045Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:de14ebd737ad398752fdafeb80f2c84fffae67a7d4c481601bb81ab6dcd67943","observation_id":"66f0e11c-4939-41d8-9aac-3c61ab8b6947","resolution":{"observed_at":"2026-08-09T04:32:43.819467Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14992","last_updated":"2023-10-23T07:24:28Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T10:28:28Z","title":"Reasoning with Language Model is Planning with World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14992","snapshot_observed_at":"2026-08-09T04:32:42.283380Z","title":"J., Wang, Z., Wang, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.283380Z"},"links":{"cited_paper":"/paper/2305.14992","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:7d30d7599e987aa350d8e5f9706d0b8cb9c886dd49f1a66e2e58f2e5a88a4ab9","observation_id":"6651cd5b-3d05-4050-a0ab-16cefd2bf677","resolution":{"observed_at":"2026-08-09T04:32:42.283380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10620","last_updated":"2024-04-10T08:41:22Z","snapshot_observed_at":"2026-07-06T16:08:29.285279Z","submitted_at":"2023-08-21T10:37:49Z","title":"Large Language Models for Software Engineering: A Systematic Literature Review","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10620","snapshot_observed_at":"2026-08-09T04:32:42.287128Z","title":"Large language models for software engineering: A systematic literature review","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.287128Z"},"links":{"cited_paper":"/paper/2308.10620","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:cc526127d89995cb901ff880d2c69886f8f010b32ebba6874744ea5b3fd57907","observation_id":"fa8318ee-dcd3-44db-91c1-d797af860515","resolution":{"observed_at":"2026-08-09T04:32:42.287128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11911","last_updated":"2024-10-09T06:59:31Z","snapshot_observed_at":"2026-08-04T07:10:48.980283Z","submitted_at":"2024-06-16T16:46:55Z","title":"A Notion of Complexity for Theory of Mind via Discrete World Models","version":3},"cited_work":{"arxiv_id":"2406.11911","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.11911","snapshot_observed_at":"2026-08-09T04:32:43.596780Z","title":"A Notion of Complexity for Theory of Mind via Discrete World Models","venue":"cs.AI","work_id":"1df55c72-dfa0-414e-8247-b352b73fc978","year":2024},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.291038Z"},"links":{"cited_paper":"/paper/2406.11911","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:779b2fd38a5ee7fedb384fe2dc2c7891301383e7e9b622e9c21550382468a5ba","observation_id":"f0013875-d2f1-4dee-aa50-bb2834e458ea","resolution":{"observed_at":"2026-08-09T04:32:43.601494Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14310","last_updated":"2023-03-25T00:43:41Z","snapshot_observed_at":"2026-08-04T05:03:05.820878Z","submitted_at":"2023-03-25T00:43:41Z","title":"GPT is becoming a Turing machine: Here are some ways to program it","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14310","snapshot_observed_at":"2026-08-09T04:32:42.294132Z","title":"Gpt is becoming a turing machine: Here are some ways to program it","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.294132Z"},"links":{"cited_paper":"/paper/2303.14310","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:ca96e6954d7ac5eb2610b4470ad785bd266f0d75d6c27f47656be4b6222eccaf","observation_id":"0f941a1a-546f-4c78-aca1-6e1e127986ab","resolution":{"observed_at":"2026-08-09T04:32:42.294132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15421","last_updated":"2023-10-31T17:58:30Z","snapshot_observed_at":"2026-08-06T22:17:55.289636Z","submitted_at":"2023-10-24T00:24:11Z","title":"FANToM: A Benchmark for Stress-testing Machine Theory of Mind in Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15421","snapshot_observed_at":"2026-08-09T04:32:42.318584Z","title":"L., Kim, G., Choi, Y., and Sap, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.318584Z"},"links":{"cited_paper":"/paper/2310.15421","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:6fcbe92a68507d73c731e59e475e520507b3034d3aa90dffd5b54a2541e040aa","observation_id":"dca4600e-da31-434b-8300-929d10bb0b04","resolution":{"observed_at":"2026-08-09T04:32:42.318584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02363","last_updated":"2023-09-08T17:51:51Z","snapshot_observed_at":"2026-08-08T23:33:54.745033Z","submitted_at":"2023-05-03T18:01:13Z","title":"Entity Tracking in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02363","snapshot_observed_at":"2026-08-09T04:32:42.345278Z","title":"and Schuster, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.345278Z"},"links":{"cited_paper":"/paper/2305.02363","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:d9a735e4d4ec453edeef555eaddd0ac18d2b244d6f839475565a92d30c636baf","observation_id":"5da41d64-2f69-4244-9351-44b5939b7190","resolution":{"observed_at":"2026-08-09T04:32:42.345278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16573","last_updated":"2023-11-30T07:59:26Z","snapshot_observed_at":"2026-07-06T16:25:01.609308Z","submitted_at":"2023-09-28T16:29:52Z","title":"Language Models as a Service: Overview of a New Paradigm and its Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16573","snapshot_observed_at":"2026-08-09T04:32:42.372024Z","title":"G., Shadbolt, N., and Wooldridge, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.372024Z"},"links":{"cited_paper":"/paper/2309.16573","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:79a22abd575472a3604addabcfac1a1b542447feaa26ea39078036fd70edce7d","observation_id":"7d141074-f071-4e38-9fd3-cc9cba1b5999","resolution":{"observed_at":"2026-08-09T04:32:42.372024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09074","last_updated":"2024-06-12T08:55:13Z","snapshot_observed_at":"2026-08-09T14:17:37.852580Z","submitted_at":"2024-01-17T09:23:59Z","title":"Code Simulation Challenges for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09074","snapshot_observed_at":"2026-08-09T04:32:42.402029Z","title":"Code simulation challenges for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.402029Z"},"links":{"cited_paper":"/paper/2401.09074","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:272690a302fe4dd4e0d157466d8dd743ba2f8d91b9a5135a8afaf41f55281e1c","observation_id":"9ce2bb66-143e-405e-9aed-15851d49b647","resolution":{"observed_at":"2026-08-09T04:32:42.402029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:42.435873Z","title":"Code as policies: Language model programs for embodied control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.435873Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:56bb1755c28436935cf1829c25a45bcdec8aa7088a76caacb2d0322e49e3c9ba","observation_id":"c980aef7-185a-4c1e-bd4e-b24bab99e950","resolution":{"observed_at":"2026-08-09T04:32:42.435873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.803124Z","title":"L., Hofmann, V., Yang, E","venue":null,"work_id":"7b6dea38-60a0-4798-8fe9-1c5d02faaf72","year":2024},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.468072Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:c1c46b37ea6a8affbafb6bf137bcb2e4c37d5a1d1e900e9a05b05a867697595c","observation_id":"f0cb053d-d844-450c-96e6-ff1cb80e36ee","resolution":{"observed_at":"2026-08-09T04:32:43.806195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05383","last_updated":"2023-05-08T10:00:05Z","snapshot_observed_at":"2026-08-09T17:17:59.722767Z","submitted_at":"2023-05-08T10:00:05Z","title":"Code Execution with Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05383","snapshot_observed_at":"2026-08-09T04:32:42.487463Z","title":"Code execution with pre-trained language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.487463Z"},"links":{"cited_paper":"/paper/2305.05383","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:b4e9c31942694aa4fff4c54ed1d9b14a8258ff9c404c3ab656081ddf3998c85c","observation_id":"c4b0de17-198b-4866-8fdc-3c66a8dd9ae7","resolution":{"observed_at":"2026-08-09T04:32:42.487463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.795155Z","title":"D., Ibrahimzada, A","venue":null,"work_id":"d74ee82b-fa26-42c7-affd-ac1c720d4760","year":2024},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.528116Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:f4b984c14b8f7ae88e0b9123ca13d3597db88f1f15dbec1944ebc247446a685c","observation_id":"c7261df1-facd-44a9-b7e9-46e2e0b24d98","resolution":{"observed_at":"2026-08-09T04:32:43.798145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06667","last_updated":"2024-10-10T05:12:44Z","snapshot_observed_at":"2026-08-07T18:44:02.722182Z","submitted_at":"2024-10-09T08:23:22Z","title":"Large Language Models as Code Executors: An Exploratory Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06667","snapshot_observed_at":"2026-08-09T04:32:42.559843Z","title":"Large language models as code executors: An exploratory study, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.559843Z"},"links":{"cited_paper":"/paper/2410.06667","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:d82cf86b0027177d8c4f3f46c632c38e4c49f02b575f4f0fccf38e8d9566b792","observation_id":"6b42a7d7-952c-4187-92fd-c082411fc2c2","resolution":{"observed_at":"2026-08-09T04:32:42.559843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.786706Z","title":"T., Smolensky, P., Linzen, T., Gao, J., and Celikyilmaz, A","venue":null,"work_id":"f6e98d35-107d-453d-8bd4-d853cdc2fb32","year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.598672Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:eae621134e168bf4702d2b44168b569ad38fcee9f212a44c8b4dce7e19f2bd07","observation_id":"aa774ee2-60a4-4849-8caa-12566484eca8","resolution":{"observed_at":"2026-08-09T04:32:43.789878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.13638","last_updated":"2023-09-24T13:35:28Z","snapshot_observed_at":"2026-07-06T16:22:58.752949Z","submitted_at":"2023-09-24T13:35:28Z","title":"Embers of Autoregression: Understanding Large Language Models Through the Problem They are Trained to Solve","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.13638","snapshot_observed_at":"2026-08-09T04:32:42.615052Z","title":"T., Yao, S., Friedman, D., Hardy, M., and Griffiths, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.615052Z"},"links":{"cited_paper":"/paper/2309.13638","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:364d2cfa68b3b361d48a990a902456438025fa7390664703b6937f83334f2f4b","observation_id":"8b9710ee-d728-4c16-9ff2-c4c8e2fd9c48","resolution":{"observed_at":"2026-08-09T04:32:42.615052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00114","last_updated":"2021-11-30T21:32:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-30T21:32:46Z","title":"Show Your Work: Scratchpads for Intermediate Computation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00114","snapshot_observed_at":"2026-08-09T04:32:42.636429Z","title":"J., Gur-Ari, G., Michalewski, H., Austin, J., Bieber, D., Dohan, D., Lewkowycz, A., Bosma, M., Luan, D., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.636429Z"},"links":{"cited_paper":"/paper/2112.00114","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:2c0c9e15e9027f604fbf658c568372a1be2c440c8b00d73603d78c8a37332a06","observation_id":"607d1371-2564-4ae3-9d2d-7947d96e989f","resolution":{"observed_at":"2026-08-09T04:32:42.636429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.778445Z","title":"In-context learning and induction heads","venue":null,"work_id":"f9d7af4a-d4fe-4001-ac51-a8e453b55d86","year":2022},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.666590Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:8b16bad4018493d2bde172f5c2c91cd7b49012549dd1bfd47a4be1924026d39f","observation_id":"a03f880b-e71b-43a3-9f97-5d88c7c8e106","resolution":{"observed_at":"2026-08-09T04:32:43.781501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T04:32:42.689942Z","title":"GPT-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.689942Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:04250a1f48c9a288076abee4f286dfcbec36f65e2a42311cb60820e7a7b86d3f","observation_id":"9bfec234-86a8-43e6-9461-4d034ce7a16c","resolution":{"observed_at":"2026-08-09T04:32:42.689942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.769845Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"b549fc51-908a-4189-aaf6-9251dec17d25","year":2022},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.724295Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:a625298584a1ab4d1edfdec6725b352ad3645b961296c4974360f64c88a7b89e","observation_id":"da52d1d8-78c9-4bcd-8e8e-0a45bb9b2a37","resolution":{"observed_at":"2026-08-09T04:32:43.773189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.761220Z","title":"Attention is turing complete","venue":null,"work_id":"ce3d3143-ce54-4634-9d58-b39cfaf76203","year":2021},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.750218Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:330d9f90c0c45e8dfcd9c6930877c3089a251baf0a89d8701d317940138c836e","observation_id":"a51bac73-fca4-4ea6-9c7e-4a59dc184148","resolution":{"observed_at":"2026-08-09T04:32:43.764254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.752843Z","title":null,"venue":null,"work_id":"d2b96790-4c71-4b7a-992f-11ed47988656","year":2018},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.777172Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:0be3b675fb903af2f24acf44c5ad176a116b3f8c9ea20f4d5e8bd2924a46f51a","observation_id":"c073f317-8290-4029-adad-0886a3b882d1","resolution":{"observed_at":"2026-08-09T04:32:43.755747Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-09T04:32:42.790809Z","title":"E., Adi, Y., Liu, J., Remez, T., Rapin, J., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.790809Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:97e6510360416f3cc478a10cee8d74c68dc1903d81aa9f087c72c8751085ea32","observation_id":"5a5423d9-731d-4928-96f6-c5d746946883","resolution":{"observed_at":"2026-08-09T04:32:42.790809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.744560Z","title":"A., Prasad, P., and Becker, B","venue":null,"work_id":"275085ad-3363-4a11-b120-8676de2a52b2","year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.801620Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:dc7693bcdee233cde09b3b8fa7e9ddc91ed139dd414ee87fd141f35f15c0c28a","observation_id":"89ea30e1-877a-4ef9-be3a-02d9681f840c","resolution":{"observed_at":"2026-08-09T04:32:43.747550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-09T04:32:42.805085Z","title":"L., Fan, A., Akiki, C., Pavlick, E., Ili \\'c , S., Hesslow, D., Castagn \\'e , R., Luccioni, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.805085Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:302e895af5ca86758513fa27add68f260a82468b95dfd9bc0a5b5c24b855d89f","observation_id":"23d26f0e-fd33-48ea-b390-08dd1a7a90cb","resolution":{"observed_at":"2026-08-09T04:32:42.805085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04589","last_updated":"2023-01-10T02:37:44Z","snapshot_observed_at":"2026-08-09T22:43:26.313132Z","submitted_at":"2023-01-10T02:37:44Z","title":"Memory Augmented Large Language Models are Computationally Universal","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04589","snapshot_observed_at":"2026-08-09T04:32:42.808385Z","title":"Memory augmented large language models are computationally universal","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.808385Z"},"links":{"cited_paper":"/paper/2301.04589","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:ff860e6cd34a682e5cfe9d309c388d40391beb2818384d9bafcfbbc1e8744182","observation_id":"6180b11d-dbe0-4b85-b2f7-3be2a4f20ca0","resolution":{"observed_at":"2026-08-09T04:32:42.808385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16789","last_updated":"2024-03-09T22:26:06Z","snapshot_observed_at":"2026-08-08T18:07:29.632928Z","submitted_at":"2023-10-25T17:21:23Z","title":"Detecting Pretraining Data from Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16789","snapshot_observed_at":"2026-08-09T04:32:42.812143Z","title":"Detecting pretraining data from large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.812143Z"},"links":{"cited_paper":"/paper/2310.16789","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:e521d9341c8f86580450c987d5602da98e11fb33cd5968e262038d40422b114f","observation_id":"f1df04f0-3c13-42be-89d6-8322a1525099","resolution":{"observed_at":"2026-08-09T04:32:42.812143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.736687Z","title":"and Chandler, P","venue":null,"work_id":"0a366ba9-3260-4b63-b648-8174c8d3f434","year":1991},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.815763Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:aa37074fe8e7266b7b55e8a0c2ed0eda990302e1745fd77482cd283fdb491426","observation_id":"4cada386-a6aa-4a83-bd18-78c0709e2ce2","resolution":{"observed_at":"2026-08-09T04:32:43.739377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13383","last_updated":"2023-07-25T10:07:02Z","snapshot_observed_at":"2026-07-06T15:58:12.694734Z","submitted_at":"2023-07-25T10:07:02Z","title":"Predicting Code Coverage without Execution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13383","snapshot_observed_at":"2026-08-09T04:32:42.818889Z","title":"Predicting code coverage without execution","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.818889Z"},"links":{"cited_paper":"/paper/2307.13383","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:89fb7f66f7f94a793bd2c401d4c9aa40a2ef7b2d09537763088c4c7d008ef995","observation_id":"8702dc1b-d10f-4498-a33b-e9e0fff95c8a","resolution":{"observed_at":"2026-08-09T04:32:42.818889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.728704Z","title":"Language models don't always say what they think: unfaithful explanations in chain-of-thought prompting","venue":null,"work_id":"082d0d93-6fed-4f82-a5d0-420e0c3aad5a","year":2024},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.837580Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:dcc577bbc306a873ce1d299b4dee641efce26cee653e26f11190a0b78475a4ab","observation_id":"6c726e9f-2cce-46c9-8cdd-09fd45b2a9ee","resolution":{"observed_at":"2026-08-09T04:32:43.731762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.370076Z","title":null,"venue":null,"work_id":"8f2b2fb8-651c-4872-b84b-073620a55d3b","year":2022},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.859396Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:09581e59a2a56c733ddab6aa09fcb6809844a3888b9693c5cde11e460bf94c68","observation_id":"5fcd7aae-0663-4999-bdd1-c17be48bd7a4","resolution":{"observed_at":"2026-08-09T04:32:43.374785Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.720947Z","title":"J., and Lu, H","venue":null,"work_id":"3dd4a99c-7246-48ed-a621-8625e7fc2762","year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.883817Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:43b234d55300b0bbb9c63de35f5b0236e26c3827b636532e338191a95bc257b0","observation_id":"5d28543d-f7bd-4a99-b439-e4b85c90d1bd","resolution":{"observed_at":"2026-08-09T04:32:43.723654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.712709Z","title":"Statistically meaningful approximation: a case study on approximating turing machines with transformers","venue":null,"work_id":"057f866d-5544-434e-bdb1-0a665b723d99","year":2022},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.906648Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:a489d7d0573e531911681113580efbbf36501b02c151cb1953d3a60333551190","observation_id":"d3b36a1c-b2b3-4314-9875-3e119f6eb22a","resolution":{"observed_at":"2026-08-09T04:32:43.715745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-09T04:32:42.940751Z","title":"Chain of thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.940751Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:309045b7329bff6a8d18b0563f6d8ba42ab77e42468ee4c32fab213e9ad2fe79","observation_id":"fa2c7cc5-60cf-4991-90e7-fead2f3c0607","resolution":{"observed_at":"2026-08-09T04:32:42.940751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.704141Z","title":"Thinking like transformers","venue":null,"work_id":"1ddf4d56-8130-4e7f-82d2-b5e1f875a5c0","year":2021},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.972864Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:a3953521c048bbddbdaefe94ef1b76b8e587f83cdccdfa062cbc021eaad093e2","observation_id":"ffa4477e-3a34-49ee-85ec-78215f0bae63","resolution":{"observed_at":"2026-08-09T04:32:43.707085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00059","last_updated":"2023-10-31T18:07:07Z","snapshot_observed_at":"2026-07-06T16:41:19.189036Z","submitted_at":"2023-10-31T18:07:07Z","title":"The Generative AI Paradox: \"What It Can Create, It May Not Understand\"","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00059","snapshot_observed_at":"2026-08-09T04:32:42.991740Z","title":"what it can create, it may not understand","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:42.991740Z"},"links":{"cited_paper":"/paper/2311.00059","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:6ae09975c6424bba3d1ca52d49b5994960483a74d9c41bb1771db5dd13449714","observation_id":"cf0c0a9f-3d93-473c-a15a-46fefcf4982c","resolution":{"observed_at":"2026-08-09T04:32:42.991740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10793","last_updated":"2023-07-20T11:46:48Z","snapshot_observed_at":"2026-08-07T22:00:49.278349Z","submitted_at":"2023-07-20T11:46:48Z","title":"Addressing Compiler Errors: Stack Overflow or Large Language Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10793","snapshot_observed_at":"2026-08-09T04:32:43.021712Z","title":"and Treude, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:43.021712Z"},"links":{"cited_paper":"/paper/2307.10793","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:57e3379dfc54a37c569d9fc76abc044df97cb679c22db3329e52ea95496f363b","observation_id":"cac0ea12-e5c7-4159-96a9-8a438da1fbe2","resolution":{"observed_at":"2026-08-09T04:32:43.021712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09932","last_updated":"2024-01-12T02:39:25Z","snapshot_observed_at":"2026-08-08T05:44:48.307884Z","submitted_at":"2023-08-19T07:25:39Z","title":"Unveiling Memorization in Code Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09932","snapshot_observed_at":"2026-08-09T04:32:43.054085Z","title":"What do code models memorize? an empirical study on large language models of code","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:43.054085Z"},"links":{"cited_paper":"/paper/2308.09932","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:f0f9f646f9c9abdf474d92ef67896a60241de9cfe4cd5a68228be3952e80c4a0","observation_id":"48dca507-485b-4f94-9087-ff004bbf46b5","resolution":{"observed_at":"2026-08-09T04:32:43.054085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02015","last_updated":"2023-03-16T09:28:15Z","snapshot_observed_at":"2026-08-04T17:38:55.806742Z","submitted_at":"2023-03-16T09:28:15Z","title":"How well do Large Language Models perform in Arithmetic tasks?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02015","snapshot_observed_at":"2026-08-09T04:32:43.086678Z","title":"How well do large language models perform in arithmetic tasks? arXiv preprint arXiv:2304.02015, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:43.086678Z"},"links":{"cited_paper":"/paper/2304.02015","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:0986f731907d196afd843f2354b0dcb254785320343919d2b5256ae0a3ff1aa2","observation_id":"82e21b28-e62c-40e4-9576-c40b6235649d","resolution":{"observed_at":"2026-08-09T04:32:43.086678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.695193Z","title":"Large language models meet nl2code: A survey","venue":null,"work_id":"7b26607d-2c39-45fd-a420-ea01151c7539","year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:43.089536Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:8e9daa9bed4b13961c1dfef57e7ed498e0d164df3fa9be2e406479036140e0f7","observation_id":"262b4bea-ceb3-49f5-92ca-e1be1bb3c723","resolution":{"observed_at":"2026-08-09T04:32:43.698537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:43.686581Z","title":"Transformer-based models are not yet perfect at learning to emulate structural recursion, 2024","venue":null,"work_id":"0f106432-82a4-49c1-89b5-4974c807b2d6","year":2024},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:43.092025Z"},"links":{"citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:3fe3e182dfa9bbd745040fe960ce5e4a46a48d38d6c40ec725ef552cccf7f973","observation_id":"a115d276-8ea9-4839-9dcb-ec94ba7cea23","resolution":{"observed_at":"2026-08-09T04:32:43.689807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14699","last_updated":"2023-06-25T18:38:38Z","snapshot_observed_at":"2026-07-06T15:32:14.701994Z","submitted_at":"2023-05-24T04:08:37Z","title":"Can Transformers Learn to Solve Problems Recursively?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14699","snapshot_observed_at":"2026-08-09T04:32:43.094507Z","title":"D., Tigges, C., Biderman, S., Raginsky, M., and Ringer, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:43.094507Z"},"links":{"cited_paper":"/paper/2305.14699","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:6ef8b6cf725627f280e3b4352c06c2e7ec50f43f292f9152b4c370cbb404993e","observation_id":"79174ed3-6ec7-4911-8498-1c760448f352","resolution":{"observed_at":"2026-08-09T04:32:43.094507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16028","last_updated":"2023-10-24T17:43:29Z","snapshot_observed_at":"2026-07-06T16:37:58.121261Z","submitted_at":"2023-10-24T17:43:29Z","title":"What Algorithms can Transformers Learn? A Study in Length Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16028","snapshot_observed_at":"2026-08-09T04:32:43.097070Z","title":"What algorithms can transformers learn? a study in length generalization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-09T04:32:43.097070Z"},"links":{"cited_paper":"/paper/2310.16028","citing_paper":"/paper/2502.03568"},"observation_digest":"sha256:7c0483d2931e7b8930efffe51e6fc9a7541ca8f956ebc5d4c3dfb74740c74a37","observation_id":"276fd243-28ea-4c22-a5d5-b505bb565ecf","resolution":{"observed_at":"2026-08-09T04:32:43.097070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.03568","last_updated":"2025-07-04T16:53:00Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T06:40:24.468945Z","submitted_at":"2025-02-05T19:30:28Z","title":"Code Simulation as a Proxy for High-order Tasks in Large Language Models"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":37,"verified_exact":1,"verified_fuzzy":17},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 4 inbound Pith citation observations for arXiv:2502.03568."}