{"as_of":"2026-08-14T06:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7b389ee8afe5676b443ae5d0a78330803bdfa0772cb0036b33027880e983dedd","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":23,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:42:49.263920Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T20:46:14.059699Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-12T12:42:49.263920Z","title":"Llms still can’t plan; can lrms? a preliminary evaluation of openai’s o1 on planbench","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17760","last_updated":"2024-11-26T00:44:37Z","snapshot_observed_at":"2026-08-13T12:34:57.336513Z","submitted_at":"2024-11-26T00:44:37Z","title":"Efficient Self-Improvement in Multimodal Large Language Models: A Model-Level Judge-Free Approach","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T12:42:49.263920Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2411.17760"},"observation_digest":"sha256:4863ef33dd1be39b143af5eebec60d47bf10520d0199718556e1d92ff9aa340e","observation_id":"b76cbf24-7d04-465b-ad59-d167cca69c75","resolution":{"observed_at":"2026-08-12T12:42:49.263920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-12T11:31:14.690983Z","title":"Valmeekam, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18147","last_updated":"2024-11-27T08:53:16Z","snapshot_observed_at":"2026-08-13T04:13:46.316609Z","submitted_at":"2024-11-27T08:53:16Z","title":"Online Knowledge Integration for 3D Semantic Mapping: A Survey","version":1},"reference_index":159,"source":"pdf_text","source_observed_at":"2026-08-12T11:31:14.690983Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2411.18147"},"observation_digest":"sha256:46f97b8856da36bc619c4261f9aab6f23bbb6df04ac0200c11fbeaa75a1d862e","observation_id":"be6321c4-1366-420e-add6-5cdf7abb7dc5","resolution":{"observed_at":"2026-08-12T11:31:14.690983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-11T23:51:53.839149Z","title":"Llms still can't plan; can lrms? A preliminary evaluation of openai's o1 on planbench","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02136","last_updated":"2024-12-03T03:49:27Z","snapshot_observed_at":"2026-08-14T02:23:50.906402Z","submitted_at":"2024-12-03T03:49:27Z","title":"Graph Learning for Planning: The Story Thus Far and Open Challenges","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-11T23:51:53.839149Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2412.02136"},"observation_digest":"sha256:9ae30eafab9013ccf5005ddeeb6170c17374fb8ccc0caf3ecea1cfda394cace5","observation_id":"35243b79-c6c3-4935-b2ed-79fec76bb65d","resolution":{"observed_at":"2026-08-11T23:51:53.839149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-11T20:43:34.529366Z","title":"Surv., 50: 84:1–84:32","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.05528","last_updated":"2024-12-07T04:00:25Z","snapshot_observed_at":"2026-08-12T12:38:25.710124Z","submitted_at":"2024-12-07T04:00:25Z","title":"AI Planning: A Primer and Survey (Preliminary Report)","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T20:43:34.529366Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2412.05528"},"observation_digest":"sha256:e65aced0acf0709a7ebd7ab66f8405147da6ad3a7f171b24f31b175169975c3c","observation_id":"493b5894-f399-42a2-823c-143da3e17195","resolution":{"observed_at":"2026-08-11T20:43:34.529366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-10T20:24:00.944897Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08716","last_updated":"2025-01-15T10:57:55Z","snapshot_observed_at":"2026-08-10T20:16:54.586645Z","submitted_at":"2025-01-15T10:57:55Z","title":"The Inherent Limits of Pretrained LLMs: The Unexpected Convergence of Instruction Tuning and In-Context Learning Capabilities","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T20:24:00.944897Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2501.08716"},"observation_digest":"sha256:f16014792a35b49026950834f4d3872747cdffd41643b348f3ef2f9b78de5290","observation_id":"dfa1a89b-06f9-408f-95b3-0bb9fe725984","resolution":{"observed_at":"2026-08-10T20:24:00.944897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":"2409.13373","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-07-01T20:46:14.059699Z","title":"Valmeekam, K","venue":null,"work_id":"dd0d63fa-1380-4370-84f6-17c2dbe3c3ac","year":2025},"citing_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"reference_index":146,"source":"pdf_text","source_observed_at":"2026-05-15T21:20:59.128986Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2501.09686"},"observation_digest":"sha256:501444a08d8a5630f386e9f99b5f6094588099cdf0789f241d4fcdf0d2f4ca5e","observation_id":"0ef2c66e-f8bd-463a-af41-24e46fee40ee","resolution":{"observed_at":"2026-05-15T21:20:59.312729Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":"2409.13373","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-07-01T20:46:14.059699Z","title":"Valmeekam, K","venue":null,"work_id":"dd0d63fa-1380-4370-84f6-17c2dbe3c3ac","year":2025},"citing_paper":{"arxiv_id":"2501.16150","last_updated":"2026-03-27T07:41:10Z","snapshot_observed_at":"2026-08-02T22:37:46.736145Z","submitted_at":"2025-01-27T15:44:02Z","title":"A Comprehensive Survey of Agents for Computer Use: Foundations, Challenges, and Future Directions","version":3},"reference_index":157,"source":"pdf_text","source_observed_at":"2026-05-23T04:59:36.994758Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2501.16150"},"observation_digest":"sha256:e88bc10383b04345d32d5b8b05af04fe93c5841b9c682d310dc8a88694f840a3","observation_id":"8db6e529-9719-4a96-84a7-908ef14ccbbb","resolution":{"observed_at":"2026-05-23T05:02:35.955850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-08T21:45:45.438262Z","title":"Llms still can’t plan; can lrms? a preliminary evaluation of openai’s o1 on planbench.arXiv preprint arXiv:2409.13373, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T19:51:35.380244Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.438262Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:a262825fe8cd6de98acccef0fffd9452d19452a70a8a020c2d48debb3e58c7c8","observation_id":"d1ec938e-c08e-4c54-8447-311a147ecf4c","resolution":{"observed_at":"2026-08-08T21:45:45.438262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-08T14:24:50.439003Z","title":"Llms still can't plan; can lrms? a preliminary evaluation of openai's o1 on planbench, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-13T20:26:56.138281Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.439003Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:61293531336b953c4ff6f3bb4fc161495bef9e1043e7e9c555bfb9f1ea85abd1","observation_id":"e2581515-9656-4d94-8da8-fefae582a480","resolution":{"observed_at":"2026-08-08T14:24:50.439003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-08T13:53:58.434511Z","title":"LLMs still can't plan; can LRMs ? a preliminary evaluation of OpenAI 's o1 on PlanBench","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-12T08:05:20.556490Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.434511Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:24351c26eef120a8d49cb7a1c2019d1377d9873cc532684595e2fa36c173b0c1","observation_id":"a252b1d1-2e84-4f6c-997d-bb3ee9f24002","resolution":{"observed_at":"2026-08-08T13:53:58.434511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-07T12:17:11.933468Z","title":"Knowledge-based artificial neural networks","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2505.24874","last_updated":"2025-05-30T17:59:46Z","snapshot_observed_at":"2026-08-12T14:21:14.252323Z","submitted_at":"2025-05-30T17:59:46Z","title":"The Road to Generalizable Neuro-Symbolic Learning Should be Paved with Foundation Models","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-07T12:17:11.933468Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2505.24874"},"observation_digest":"sha256:3227ec63569e4aebce8f0e39918d17352c13c99165d9e6b9fb466674ce3f7a0d","observation_id":"22eb4399-b9e0-4c8c-bcac-f6660bdcc979","resolution":{"observed_at":"2026-08-07T12:17:11.933468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-07T04:28:46.939636Z","title":"Llms still can't plan; can lrms? a preliminary evaluation of openai's o1 on planbench","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-13T06:21:30.822814Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.939636Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:3a0dcdd588b173b4d88fa90f17ac175d91580a577bf00895f6f18c71dc2514e3","observation_id":"16a779d1-6d61-4191-9907-fea88806053e","resolution":{"observed_at":"2026-08-07T04:28:46.939636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-06T21:13:13.017038Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00711","last_updated":"2025-07-01T12:14:22Z","snapshot_observed_at":"2026-08-13T17:27:22.573406Z","submitted_at":"2025-07-01T12:14:22Z","title":"Large Reasoning Models are not thinking straight: on the unreliability of thinking trajectories","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T21:13:13.017038Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2507.00711"},"observation_digest":"sha256:18317297add65fff4e04e1ef02f7d13f6f72fa1829c2c27ee44fbb8f54290d71","observation_id":"0eea2786-3587-46b6-8b5f-be4c58072569","resolution":{"observed_at":"2026-08-06T21:13:13.017038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-06T10:45:59.558754Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23589","last_updated":"2025-07-31T14:25:54Z","snapshot_observed_at":"2026-08-10T14:15:07.176654Z","submitted_at":"2025-07-31T14:25:54Z","title":"Can LLM-Reasoning Models Replace Classical Planning? A Benchmark Study","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T10:45:59.558754Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2507.23589"},"observation_digest":"sha256:4e198ce4fe6a8c8dca0646ac4b88236f82f535205c673428b5ea21c2eb12ab92","observation_id":"fcc2a004-06f6-47e3-a5c9-d9af1404e752","resolution":{"observed_at":"2026-08-06T10:45:59.558754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":"2409.13373","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-07-01T20:46:14.059699Z","title":"Valmeekam, K","venue":null,"work_id":"dd0d63fa-1380-4370-84f6-17c2dbe3c3ac","year":2025},"citing_paper":{"arxiv_id":"2508.16745","last_updated":"2026-05-07T14:29:44Z","snapshot_observed_at":"2026-08-02T06:49:37.602255Z","submitted_at":"2025-08-22T18:57:08Z","title":"Beyond Memorization: Extending Reasoning Depth with Recurrence, Memory and Test-Time Compute Scaling","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-18T20:49:26.966293Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2508.16745"},"observation_digest":"sha256:bdcc5ea64c9062dde44e74ccb2f28cb8e5d1e78ec025be119736c04461001499","observation_id":"db498e8f-a55a-414b-8b03-363333ea7d8e","resolution":{"observed_at":"2026-05-18T20:51:50.864328Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-05T13:05:33.736041Z","title":"LLMs Still Can’t Plan; Can LRMs? A Preliminary Evaluation of OpenAI’s o1 on PlanBench","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00971","last_updated":"2025-09-03T05:36:42Z","snapshot_observed_at":"2026-08-12T18:37:04.107350Z","submitted_at":"2025-08-31T19:31:53Z","title":"CoreThink: A Symbolic Reasoning Layer to reason over Long Horizon Tasks with LLMs","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T13:05:33.736041Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2509.00971"},"observation_digest":"sha256:29d4ac45b96e2f47cf8ca96c41dadc0c5618aef15f5185168e289308690a6c27","observation_id":"ca01ad81-91f9-4a27-a92f-8287cd1823b2","resolution":{"observed_at":"2026-08-05T13:05:33.736041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":"2409.13373","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-07-01T20:46:14.059699Z","title":"Valmeekam, K","venue":null,"work_id":"dd0d63fa-1380-4370-84f6-17c2dbe3c3ac","year":2025},"citing_paper":{"arxiv_id":"2601.19924","last_updated":"2026-05-14T05:54:54Z","snapshot_observed_at":"2026-08-11T14:52:17.163638Z","submitted_at":"2026-01-09T09:22:33Z","title":"OPT-Engine: Benchmarking the Limits of LLMs in Optimization Modeling via Complexity Scaling","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T16:17:43.055124Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2601.19924"},"observation_digest":"sha256:5e14bd7b29beb6a8c3fdea16feb3a8302518cad77a3977031e6d29df02230450","observation_id":"7a34e7a8-7f36-43df-ac75-2086d5ec205c","resolution":{"observed_at":"2026-05-16T16:18:05.361987Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-02T22:26:38.525975Z","title":"Llms still can't plan; can lrms? a preliminary evaluation of openai's o1 on planbench","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.16902","last_updated":"2026-05-30T16:45:37Z","snapshot_observed_at":"2026-08-08T21:03:21.486519Z","submitted_at":"2026-02-18T21:33:59Z","title":"LLM-WikiRace Benchmark: How Far Can LLMs Plan over Real-World Knowledge Graphs?","version":4},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T22:26:38.525975Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2602.16902"},"observation_digest":"sha256:7743276332c576b20b8b0c1f8ae3e1bbfc5e48313b911a01fdb3abaeef75bcb1","observation_id":"2f2f336b-d722-4d80-9679-9e5b1989b44a","resolution":{"observed_at":"2026-08-02T22:26:38.525975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":"2409.13373","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-07-01T20:46:14.059699Z","title":"Valmeekam, K","venue":null,"work_id":"dd0d63fa-1380-4370-84f6-17c2dbe3c3ac","year":2025},"citing_paper":{"arxiv_id":"2604.17830","last_updated":"2026-04-20T05:32:47Z","snapshot_observed_at":"2026-08-13T06:20:44.364004Z","submitted_at":"2026-04-20T05:32:47Z","title":"SYMBOLIZER: Symbolic Model-free Task Planning with VLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T05:10:38.939375Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2604.17830"},"observation_digest":"sha256:13f76622a22f89a3e385b2cf7b424fd664ad40592214c0a178044855fd4eb44e","observation_id":"271c43f6-fbee-40df-ac67-99d40c02221d","resolution":{"observed_at":"2026-05-10T09:43:49.597853Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":"2409.13373","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-07-01T20:46:14.059699Z","title":"Valmeekam, K","venue":null,"work_id":"dd0d63fa-1380-4370-84f6-17c2dbe3c3ac","year":2025},"citing_paper":{"arxiv_id":"2606.00981","last_updated":"2026-05-31T03:28:42Z","snapshot_observed_at":"2026-08-02T22:30:31.804131Z","submitted_at":"2026-05-31T03:28:42Z","title":"Robust Asynchronous Planning via Auto-Formalization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T17:43:24.820773Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2606.00981"},"observation_digest":"sha256:6a9464bb2d83b6db08c9ba115229b7f0f443729a7a514d4b9243823253e2d754","observation_id":"d62170c4-c495-43ea-99d1-c0f787ed6409","resolution":{"observed_at":"2026-07-01T20:46:14.061633Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-07-14T10:13:55.891370Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10651","last_updated":"2026-07-12T08:34:59Z","snapshot_observed_at":"2026-08-13T00:58:49.624046Z","submitted_at":"2026-07-12T08:34:59Z","title":"Embark Now: User Demand Oriented Framework for Multi-day Urban Travel Itinerary Planning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-14T10:13:55.891370Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2607.10651"},"observation_digest":"sha256:f63d79df9a3f3075e67ad41406cc700946df643508803529a80660893b7548b8","observation_id":"2ae09f3e-bb85-4f3c-8a70-a6d10b6d9e6b","resolution":{"observed_at":"2026-07-14T10:13:55.891370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-01T03:48:35.008851Z","title":"LLMs still can’t plan; can LRMs? a preliminary evaluation of OpenAI’s o1 on PlanBench.arXiv preprint arXiv:2409.13373,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23055","last_updated":"2026-07-25T05:46:17Z","snapshot_observed_at":"2026-08-06T20:30:50.092207Z","submitted_at":"2026-07-25T05:46:17Z","title":"SymStep: Symbolic Step Verification for Logical Reasoning","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-01T03:48:35.008851Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2607.23055"},"observation_digest":"sha256:3190f1eb3849772d2fda3e3d699b878970477d98ad82cae607cf5a13c1b6f275","observation_id":"f1378f71-7fa8-4b2a-a07d-ac12e0427fd7","resolution":{"observed_at":"2026-08-01T03:48:35.008851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-07-30T23:41:20.670945Z","title":"LLMs still can’t plan; can LRMs? A preliminary evaluation of OpenAI’s o1 on PlanBench.arXiv preprint arXiv:2409.13373,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23386","last_updated":"2026-07-25T22:40:02Z","snapshot_observed_at":"2026-08-13T22:17:32.684768Z","submitted_at":"2026-07-25T22:40:02Z","title":"Confidently Wrong: Exception Chain Collapse in Frontier LLM Rule Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T23:41:20.670945Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2607.23386"},"observation_digest":"sha256:dc1479a41aa796e0af5e5bddb9adee1d6eefafddb3a64d15c6a952ded78c1207","observation_id":"3d53ffc1-8162-43c9-9076-006a108fe105","resolution":{"observed_at":"2026-07-30T23:41:20.670945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2409.13373/citation-record","integrity":"/paper/2409.13373/integrity","json":"/paper/2409.13373/citation-record.json","paper":"/paper/2409.13373"},"outbound":[],"paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-12T22:41:07.948524Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 23 inbound Pith citation observations for arXiv:2409.13373."}