{"as_of":"2026-08-10T09:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:468f9546c58d28ae412c15db845939ce401c4cef5f3e700ee582542c1940014c","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T23:21:56.539146Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T16:42:12.973876Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-24T03:55:59.615422Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"cited_work":{"arxiv_id":"2501.18482","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18482","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A tool for in-depth analysis of code execution reasoning of large language models","venue":null,"work_id":"418fa692-8ee7-4df7-abd8-8ed8f086b0b2","year":2025},"citing_paper":{"arxiv_id":"2402.09664","last_updated":"2026-04-07T05:36:18Z","snapshot_observed_at":"2026-07-06T17:30:25.359458Z","submitted_at":"2024-02-15T02:24:46Z","title":"CodeMind: Evaluating Large Language Models for Code Reasoning","version":6},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-24T03:53:55.964755Z"},"links":{"cited_paper":"/paper/2501.18482","citing_paper":"/paper/2402.09664"},"observation_digest":"sha256:9a8a405d6b5736deea6056ffc61f401a6e25f96e37e127f3c0bf81b2aa38cff0","observation_id":"82b1eb67-93a3-49df-a0eb-9dca3bd88ef0","resolution":{"observed_at":"2026-05-24T03:55:59.621421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"cited_work":{"arxiv_id":"2501.18482","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18482","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A tool for in-depth analysis of code execution reasoning of large language models","venue":null,"work_id":"418fa692-8ee7-4df7-abd8-8ed8f086b0b2","year":2025},"citing_paper":{"arxiv_id":"2510.15079","last_updated":"2026-04-07T05:37:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T18:48:12Z","title":"Assessing Coherency and Consistency of Code Execution Reasoning by Large Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T05:59:00.400429Z"},"links":{"cited_paper":"/paper/2501.18482","citing_paper":"/paper/2510.15079"},"observation_digest":"sha256:d4541da47c4ec12ffdc1711272ccb8391cd461acbe9861e637db7bbda6db46a0","observation_id":"bda5ae7e-7e24-440b-8949-36758a0270cb","resolution":{"observed_at":"2026-05-18T06:00:57.254553Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18482","snapshot_observed_at":"2026-08-03T16:42:12.973876Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.12507","last_updated":"2026-07-26T21:30:50Z","snapshot_observed_at":"2026-08-06T19:36:27.056447Z","submitted_at":"2025-12-14T01:11:11Z","title":"ATLAS: Multi-View Code Representation Tool for C and C++ Source Programs","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T16:42:12.973876Z"},"links":{"cited_paper":"/paper/2501.18482","citing_paper":"/paper/2512.12507"},"observation_digest":"sha256:893fada9d712696ec5bc5153a063d97cc8d3a5e00d82a6f9870401ba0381fe4f","observation_id":"90472f13-35c8-454e-bc37-9cdf18f40b35","resolution":{"observed_at":"2026-08-03T16:42:12.973876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"cited_work":{"arxiv_id":"2501.18482","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18482","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A tool for in-depth analysis of code execution reasoning of large language models","venue":null,"work_id":"418fa692-8ee7-4df7-abd8-8ed8f086b0b2","year":2025},"citing_paper":{"arxiv_id":"2512.14917","last_updated":"2026-04-23T22:42:11Z","snapshot_observed_at":"2026-07-31T07:00:51.587326Z","submitted_at":"2025-12-16T21:12:53Z","title":"Evaluating Code Reasoning Abilities of Large Language Models Under Real-World Settings","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T21:23:44.762007Z"},"links":{"cited_paper":"/paper/2501.18482","citing_paper":"/paper/2512.14917"},"observation_digest":"sha256:2e111c63f90ccf83f8458499582b3bd0abbcd41fd82aa003c678f6f90ba3b604","observation_id":"4f8aad15-68ef-4885-8d40-40f0dfa5556f","resolution":{"observed_at":"2026-05-16T21:28:34.189155Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"cited_work":{"arxiv_id":"2501.18482","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18482","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A tool for in-depth analysis of code execution reasoning of large language models","venue":null,"work_id":"418fa692-8ee7-4df7-abd8-8ed8f086b0b2","year":2025},"citing_paper":{"arxiv_id":"2604.21765","last_updated":"2026-04-23T15:18:50Z","snapshot_observed_at":"2026-07-06T23:08:19.446684Z","submitted_at":"2026-04-23T15:18:50Z","title":"PrismaDV: Automated Task-Aware Data Unit Test Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-09T22:14:30.829159Z"},"links":{"cited_paper":"/paper/2501.18482","citing_paper":"/paper/2604.21765"},"observation_digest":"sha256:32161246654ceb6e069f9882aac57af3dca2e0d62f1d828f06dad61d4c4efbc1","observation_id":"9a9ac8c2-30e8-4a94-b051-d14684a89e9e","resolution":{"observed_at":"2026-05-09T22:49:16.112186Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.18482/citation-record","integrity":"/paper/2501.18482/integrity","json":"/paper/2501.18482/citation-record.json","paper":"/paper/2501.18482"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T23:21:56.846470Z","title":"Matplot library for visualization","venue":null,"work_id":"0171335b-0ad9-4963-b9de-9d81630e4753","year":2025},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.410154Z"},"links":{"citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:261791221ba8a52a0825fb2e2835c94d35fd832f3b3c93b0d52567827d435d69","observation_id":"7f324cee-928e-43d3-8888-03da40944949","resolution":{"observed_at":"2026-08-09T23:21:56.850238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T23:21:56.835190Z","title":"Network Analysis in Python using NetworkX","venue":null,"work_id":"aaf27737-cc78-4708-9c57-62d5cb885915","year":2025},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.414264Z"},"links":{"citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:6b2ac23e04bb51aee229fecb6e88bcbd1d0dcd58ee04fb08e02912690a3110f5","observation_id":"1959ee53-fc92-499e-b3f8-34b084da0c15","resolution":{"observed_at":"2026-08-09T23:21:56.839878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T23:21:56.826712Z","title":"PyGraphVis library for visualization","venue":null,"work_id":"2c62b634-2ff9-4c2b-8033-81f685ce4f5f","year":2025},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.417507Z"},"links":{"citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:d38f6af18a749ab3610f9c6f3715c12c8e72df772446178140ac034ad8896170","observation_id":"7c94ded3-71ac-4737-a761-b2c52e5cb497","resolution":{"observed_at":"2026-08-09T23:21:56.829613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T23:21:56.817587Z","title":"Python AST module","venue":null,"work_id":"a8f08540-9675-4b09-b080-d746b0d1197a","year":2025},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.421174Z"},"links":{"citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:c6ebba0edfb7ff0fbb61e5290b3564f7167e1370a81f2c19223193d781a86114","observation_id":"dc010e0b-bab9-48be-8e72-eba0465e7f26","resolution":{"observed_at":"2026-08-09T23:21:56.820469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.11590","last_updated":"2023-05-04T20:22:25Z","snapshot_observed_at":"2026-07-06T11:41:38.428205Z","submitted_at":"2021-08-26T05:44:20Z","title":"AVATAR: A Parallel Corpus for Java-Python Program Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.11590","snapshot_observed_at":"2026-08-09T23:21:56.427898Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.427898Z"},"links":{"cited_paper":"/paper/2108.11590","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:2eae6b409dff65ad3f50ad1b74e0f7e59dde6bfd4a730a66f7f818cf84df3e08","observation_id":"fcbaf4df-8125-42ec-8e4e-b1fae3c0c240","resolution":{"observed_at":"2026-08-09T23:21:56.427898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-02T13:11:16.882565Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-09T23:21:56.431762Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.431762Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:f71a7f0e87c2ea40f2cb12b9c955ba8d1cd7529954fb945c19f76e8889eae8b9","observation_id":"13a0a027-1f62-4934-bd2b-626125e9f274","resolution":{"observed_at":"2026-08-09T23:21:56.431762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-09T23:21:56.434864Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.434864Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:43f727094879b74d785b4f7210b0de749568706b8420e49fe5760b6dd787540a","observation_id":"0ab8f9af-5c62-4234-ac38-9b84c30e6e08","resolution":{"observed_at":"2026-08-09T23:21:56.434864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T23:21:56.807112Z","title":null,"venue":null,"work_id":"8f2e6bd8-9bb1-493d-b0b9-150555be4ac9","year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.437953Z"},"links":{"citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:c96994ebe2cb222f35e3919d6c79d6c2bbe512cfc50a8d2cb9f5af531327f45b","observation_id":"df87e013-f5ec-4840-889c-f11569a01603","resolution":{"observed_at":"2026-08-09T23:21:56.810440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-09T23:21:56.440667Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.440667Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:b157576052f1793ea0fda4a874d83d97b36fb3e2288e98ece57c81b56fcf98f6","observation_id":"e747132f-65df-4e57-87ff-44d5d9f65799","resolution":{"observed_at":"2026-08-09T23:21:56.440667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T23:21:56.798344Z","title":null,"venue":null,"work_id":"a4121423-be6a-496c-af25-f2f3eb70b571","year":2021},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.444375Z"},"links":{"citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:65d7cf9eb89ae3bf6fd28f205e3c0a657c7382387e803a02fc93c5391efae873","observation_id":"1989865e-49a2-4bb2-9545-47c5a383c528","resolution":{"observed_at":"2026-08-09T23:21:56.801207Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01006","last_updated":"2024-10-31T23:44:31Z","snapshot_observed_at":"2026-08-10T04:10:19.528542Z","submitted_at":"2024-06-03T05:36:57Z","title":"SemCoder: Training Code Language Models with Comprehensive Semantics Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01006","snapshot_observed_at":"2026-08-09T23:21:56.448691Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.448691Z"},"links":{"cited_paper":"/paper/2406.01006","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:639ef4fccac4ff59ef3d2a28b084cc132b0bb3c41be6f40ccdb226d3b3b04b5e","observation_id":"fba8acc4-7048-44c9-8e6f-febed18b0c7f","resolution":{"observed_at":"2026-08-09T23:21:56.448691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T23:21:56.452063Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.452063Z"},"links":{"citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:f4594d917e86430a07aca06941cb87cd044f486b22ff35d9b357df4fd7ffa6bd","observation_id":"cd9a4eb1-6655-4eb1-aef8-a952d0218862","resolution":{"observed_at":"2026-08-09T23:21:56.452063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03065","last_updated":"2024-01-05T20:53:51Z","snapshot_observed_at":"2026-07-06T17:12:10.787061Z","submitted_at":"2024-01-05T20:53:51Z","title":"CRUXEval: A Benchmark for Code Reasoning, Understanding and Execution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03065","snapshot_observed_at":"2026-08-09T23:21:56.455140Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.455140Z"},"links":{"cited_paper":"/paper/2401.03065","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:7952c2cd54bac16dd0902f0a31c8708dafe4f08709649b085ea7e91c4d257014","observation_id":"7af18fb2-1aa6-40bd-930c-1fc627f756be","resolution":{"observed_at":"2026-08-09T23:21:56.455140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10160","last_updated":"2024-05-30T05:27:35Z","snapshot_observed_at":"2026-08-09T03:29:23.599751Z","submitted_at":"2023-12-15T19:16:21Z","title":"Do LVLMs Understand Charts? Analyzing and Correcting Factual Errors in Chart Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10160","snapshot_observed_at":"2026-08-09T23:21:56.458813Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.458813Z"},"links":{"cited_paper":"/paper/2312.10160","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:356674b8a71cc8002252af818781dea928c47fb643810b2e22c7a8e9abf38cba","observation_id":"651b9185-9680-4781-b51a-9fc32e24c9cf","resolution":{"observed_at":"2026-08-09T23:21:56.458813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05398","last_updated":"2023-03-04T04:43:49Z","snapshot_observed_at":"2026-08-09T20:47:04.856732Z","submitted_at":"2023-03-04T04:43:49Z","title":"MathPrompter: Mathematical Reasoning using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05398","snapshot_observed_at":"2026-08-09T23:21:56.461677Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.461677Z"},"links":{"cited_paper":"/paper/2303.05398","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:5ae0501d20d82618014f71b1de6ba8716c6f39f611078228838c2ceab55ed18c","observation_id":"25775b9d-291a-4cc8-a2c4-57b0c2623bf3","resolution":{"observed_at":"2026-08-09T23:21:56.461677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07681","last_updated":"2024-11-18T18:49:59Z","snapshot_observed_at":"2026-08-09T19:28:52.954255Z","submitted_at":"2024-11-12T09:52:40Z","title":"What Do Learning Dynamics Reveal About Generalization in LLM Reasoning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07681","snapshot_observed_at":"2026-08-09T23:21:56.464819Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.464819Z"},"links":{"cited_paper":"/paper/2411.07681","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:22afb1ccebcac57c596752623867d4cae79530db69e0866216cfcf2d17f9afb6","observation_id":"947a8b9c-2fad-4f60-b110-49fd7d28c410","resolution":{"observed_at":"2026-08-09T23:21:56.464819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09074","last_updated":"2024-06-12T08:55:13Z","snapshot_observed_at":"2026-08-09T14:17:37.852580Z","submitted_at":"2024-01-17T09:23:59Z","title":"Code Simulation Challenges for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09074","snapshot_observed_at":"2026-08-09T23:21:56.468480Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.468480Z"},"links":{"cited_paper":"/paper/2401.09074","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:b8bcebe653bc14e198eb0a287c88f718a87c5963c42c8efb2e1e14cf69be5ff8","observation_id":"2a6ca2de-8530-4182-aefb-a6b98c0a60f1","resolution":{"observed_at":"2026-08-09T23:21:56.468480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05383","last_updated":"2023-05-08T10:00:05Z","snapshot_observed_at":"2026-08-09T17:17:59.722767Z","submitted_at":"2023-05-08T10:00:05Z","title":"Code Execution with Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05383","snapshot_observed_at":"2026-08-09T23:21:56.471608Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.471608Z"},"links":{"cited_paper":"/paper/2305.05383","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:8c7fbd7fde65946c612bbc40a6436a60cf214ca0d3fe43330d137cfce5641141","observation_id":"d7b3f050-dbff-483e-a258-9dcf214bf9de","resolution":{"observed_at":"2026-08-09T23:21:56.471608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-09T23:21:56.474678Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.474678Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:ad12e7fc308b8135945122b5ea9c42ae2c40027734007c805187a5211df3a0ea","observation_id":"d8e7c7ef-c8c1-479e-9358-085747c252a5","resolution":{"observed_at":"2026-08-09T23:21:56.474678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09583","last_updated":"2025-06-04T08:58:56Z","snapshot_observed_at":"2026-08-02T06:48:43.121988Z","submitted_at":"2023-08-18T14:23:21Z","title":"WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09583","snapshot_observed_at":"2026-08-09T23:21:56.477744Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.477744Z"},"links":{"cited_paper":"/paper/2308.09583","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:d388a6cdd0bbc384b44a89e3d0ccfb2e64e9bc6295f10799070a9fa07237827f","observation_id":"dc5342ba-1455-4195-a0a0-a2b33f8c0edc","resolution":{"observed_at":"2026-08-09T23:21:56.477744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T23:21:56.480887Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.480887Z"},"links":{"citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:6b74eab2719b919c098ff7c44dcbc6cea7f31813297777d763392d180e7080ed","observation_id":"00b7f258-38fe-4478-b996-f782f12b6120","resolution":{"observed_at":"2026-08-09T23:21:56.480887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14053","last_updated":"2024-02-26T18:56:08Z","snapshot_observed_at":"2026-07-06T16:36:35.423639Z","submitted_at":"2023-10-21T16:14:56Z","title":"Beyond Accuracy: Evaluating Self-Consistency of Code Large Language Models with IdentityChain","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14053","snapshot_observed_at":"2026-08-09T23:21:56.487426Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.487426Z"},"links":{"cited_paper":"/paper/2310.14053","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:eede441e71bc9054196403c27b7b1930d74cd7897ee5f0e6ed924dcc2cf94a17","observation_id":"3913e828-59f5-4af1-9445-7a4a202b8e22","resolution":{"observed_at":"2026-08-09T23:21:56.487426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04324","last_updated":"2024-05-07T13:50:40Z","snapshot_observed_at":"2026-08-09T20:15:03.728117Z","submitted_at":"2024-05-07T13:50:40Z","title":"Granite Code Models: A Family of Open Foundation Models for Code Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04324","snapshot_observed_at":"2026-08-09T23:21:56.490339Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.490339Z"},"links":{"cited_paper":"/paper/2405.04324","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:cc6f4571648f9e9574e1ec16e0c322e3d3624839cbffa8074d4d87182ccbfa13","observation_id":"7df6ee15-98ac-4396-9348-111bc9d36de6","resolution":{"observed_at":"2026-08-09T23:21:56.490339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14662","last_updated":"2024-04-23T01:46:32Z","snapshot_observed_at":"2026-08-06T09:18:16.624465Z","submitted_at":"2024-04-23T01:46:32Z","title":"NExT: Teaching Large Language Models to Reason about Code Execution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14662","snapshot_observed_at":"2026-08-09T23:21:56.493230Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.493230Z"},"links":{"cited_paper":"/paper/2404.14662","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:3157b389f11456eed5256be12e6999c5bdf9c1ca923d279a01cc02adc6dec211","observation_id":"712134d3-4605-45be-9379-c90766fe2188","resolution":{"observed_at":"2026-08-09T23:21:56.493230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T23:21:56.496633Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.496633Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:2a6d7545e66f22c8cbe7db038f54d2d723c389f11dbdf4228316f0ff062278a8","observation_id":"a85b35e0-c260-4b29-96b3-5323f559bf8b","resolution":{"observed_at":"2026-08-09T23:21:56.496633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-09T23:21:56.500061Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.500061Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:e2a781375b7f1b71ae5e0e69a51a8e7dc9a17af875e74abed2a812ce69a9a540","observation_id":"19e34ba4-272b-4440-b3d1-e9cf3fed4e9d","resolution":{"observed_at":"2026-08-09T23:21:56.500061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-09T23:21:56.503031Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.503031Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:a85f46ff1a203fee46a1c702a4412a03344c568860d4264b0df954cf0287ada3","observation_id":"854a48a3-04e0-4daa-8a6b-53ea888d3ecc","resolution":{"observed_at":"2026-08-09T23:21:56.503031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T23:21:56.505923Z","title":null,"venue":null,"work_id":null,"year":1961},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.505923Z"},"links":{"citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:e618539b9631432fd5768315f609351664b85d5896a2cc8ee3a37fbf98a1d742","observation_id":"67f305a0-6394-4303-bce5-e11bd28078aa","resolution":{"observed_at":"2026-08-09T23:21:56.505923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-09T23:21:56.509571Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.509571Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:54a4fa11675232ba41860b04fb71dd3e97d6bf3ce53d323bd6fda668f5c36b53","observation_id":"0884f57c-ca75-44c4-9d31-628d5ceddc9f","resolution":{"observed_at":"2026-08-09T23:21:56.509571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10498","last_updated":"2023-11-26T01:15:41Z","snapshot_observed_at":"2026-07-06T13:23:11.566484Z","submitted_at":"2022-06-21T16:15:27Z","title":"PlanBench: An Extensible Benchmark for Evaluating Large Language Models on Planning and Reasoning about Change","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10498","snapshot_observed_at":"2026-08-09T23:21:56.512878Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.512878Z"},"links":{"cited_paper":"/paper/2206.10498","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:d8b5dd7e24b3fcd9f2a90c468104c280086d43f51c3d559d7a6e38e15a764a2f","observation_id":"6c337865-8896-49b5-8a4f-99a5a4cdd197","resolution":{"observed_at":"2026-08-09T23:21:56.512878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03731","last_updated":"2023-10-05T17:52:09Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:52:09Z","title":"MathCoder: Seamless Code Integration in LLMs for Enhanced Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03731","snapshot_observed_at":"2026-08-09T23:21:56.516105Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.516105Z"},"links":{"cited_paper":"/paper/2310.03731","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:34fbfba3c4045d91cd6fc357366affbc933dfb576509adc8a668d0c1233441bd","observation_id":"c2f7f0d1-e8a8-43c6-aebb-e3d6355dedbb","resolution":{"observed_at":"2026-08-09T23:21:56.516105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T23:21:56.776462Z","title":null,"venue":null,"work_id":"edfe1d68-04e0-413b-a1d2-520f8ad4477c","year":2025},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.519296Z"},"links":{"citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:bfb7b1e4a63e326100582d9848ba9c729123b4a27d09516d477e4cf0e06f577f","observation_id":"613d387b-e270-42aa-a175-46dcccd03c6f","resolution":{"observed_at":"2026-08-09T23:21:56.779262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-08-09T20:31:51.939524Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-09T23:21:56.522182Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.522182Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:c878cb1368f5567bcc5c4633bc1ef847cacd48a19a98a8d22b5e36b570882660","observation_id":"e228a793-0ab1-47cc-8a71-22afe69d5012","resolution":{"observed_at":"2026-08-09T23:21:56.522182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-09T23:21:56.525660Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.525660Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:8931aa926103f43cced4ce398ead9c4887d370f2fc5f19623999c13f1fa7d0bb","observation_id":"61030cba-491f-45cd-8355-c7321631bd40","resolution":{"observed_at":"2026-08-09T23:21:56.525660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T23:21:56.765002Z","title":null,"venue":null,"work_id":"7b337e20-2a08-40cd-ac7a-d154e4cca438","year":2025},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.529298Z"},"links":{"citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:95f9d93c5858dabdf75fe0fb6f1dff392ec419cc10a0f3bc410f90dd16e86094","observation_id":"cd4c9510-7e95-4c53-aa8a-e712839a8b04","resolution":{"observed_at":"2026-08-09T23:21:56.769827Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12947","last_updated":"2024-01-23T18:07:38Z","snapshot_observed_at":"2026-07-06T17:19:31.847730Z","submitted_at":"2024-01-23T18:07:38Z","title":"Transformer-Based Models Are Not Yet Perfect At Learning to Emulate Structural Recursion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12947","snapshot_observed_at":"2026-08-09T23:21:56.532486Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.532486Z"},"links":{"cited_paper":"/paper/2401.12947","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:718b9a4b1131639e0e54f522e0526dd08c115e6afef07c544c0d899ad5460c89","observation_id":"1de4c393-8eaf-4627-b6dc-e603240297d0","resolution":{"observed_at":"2026-08-09T23:21:56.532486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15992","last_updated":"2024-10-11T05:42:01Z","snapshot_observed_at":"2026-07-06T18:35:31.141952Z","submitted_at":"2024-06-23T02:59:15Z","title":"Can LLM Graph Reasoning Generalize beyond Pattern Memorization?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15992","snapshot_observed_at":"2026-08-09T23:21:56.535851Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.535851Z"},"links":{"cited_paper":"/paper/2406.15992","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:d38c29a1d65d20db00a5792cf822521200498a9ddc5390c352b10c1a862e2433","observation_id":"c8f5657b-725e-4ee4-8c7f-49dba59a26a0","resolution":{"observed_at":"2026-08-09T23:21:56.535851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11931","last_updated":"2024-06-17T13:51:35Z","snapshot_observed_at":"2026-08-07T06:30:25.302107Z","submitted_at":"2024-06-17T13:51:35Z","title":"DeepSeek-Coder-V2: Breaking the Barrier of Closed-Source Models in Code Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11931","snapshot_observed_at":"2026-08-09T23:21:56.539146Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.539146Z"},"links":{"cited_paper":"/paper/2406.11931","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:00d0d1c3527e5c905626ba8787147619d6f9cb82c09a5aaa1b951e52ff19a3e0","observation_id":"f5d15767-e20a-4a0f-8c8e-64785d4103fe","resolution":{"observed_at":"2026-08-09T23:21:56.539146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15507","last_updated":"2023-05-24T18:54:39Z","snapshot_observed_at":"2026-08-05T08:16:09.651498Z","submitted_at":"2023-05-24T18:54:39Z","title":"The Larger They Are, the Harder They Fail: Language Models do not Recognize Identifier Swaps in Python","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15507","snapshot_observed_at":"2026-08-09T23:21:56.483947Z","title":"arXiv preprint arXiv:2305.15507 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T23:21:56.483947Z"},"links":{"cited_paper":"/paper/2305.15507","citing_paper":"/paper/2501.18482"},"observation_digest":"sha256:5e218cb3426654120d465d07bba01232f173a70b2506d559ca04ec0d9813cd69","observation_id":"49a4fb7b-7d3d-4abb-8c0d-cfba75b1e4e5","resolution":{"observed_at":"2026-08-09T23:21:56.483947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.18482","last_updated":"2025-01-30T16:56:08Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-10T04:10:53.440712Z","submitted_at":"2025-01-30T16:56:08Z","title":"A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 5 inbound Pith citation observations for arXiv:2501.18482."}