{"as_of":"2026-08-21T12:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f5b517303d4b8be9d14869ccf93d7739b2729e3d5f53e59548129cc0eaf9936a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":59,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:02:43.679640Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T11:09:46.422756Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-12T13:52:37.946531Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15862","last_updated":"2025-01-16T06:07:12Z","snapshot_observed_at":"2026-08-17T20:52:56.856854Z","submitted_at":"2024-11-24T14:38:59Z","title":"Do LLMs Really Think Step-by-step In Implicit Reasoning?","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T13:52:37.946531Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2411.15862"},"observation_digest":"sha256:96eb2ef9fea85bd9e916286a682206cff245e026ca0ac8588fe539cb0c979547","observation_id":"24a0e5eb-5baf-4302-a3ac-26546fb9a56d","resolution":{"observed_at":"2026-08-12T13:52:37.946531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-12T13:36:44.038592Z","title":"O1 replication journey: A strategic progress report -- part 1, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16102","last_updated":"2026-06-05T23:07:54Z","snapshot_observed_at":"2026-08-14T23:12:07.733477Z","submitted_at":"2024-11-25T05:24:53Z","title":"BlendServe: Optimizing Offline Inference for Auto-regressive Large Models with Resource-aware Batching","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T13:36:44.038592Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2411.16102"},"observation_digest":"sha256:b7926ce4e9c08da2206de8b00d93aedfe9961c055a3f11165af00765a502d4a4","observation_id":"07096a4b-65a8-441f-8c82-c247288a4379","resolution":{"observed_at":"2026-08-12T13:36:44.038592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-12T13:07:48.860045Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.860045Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:d11f8f7534665a036696f8118b4d568ab334277449c510399f40243c97121788","observation_id":"f744c515-47f7-455d-a333-d908b74df1e8","resolution":{"observed_at":"2026-08-12T13:07:48.860045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-12T12:38:19.262867Z","title":"O1 replication journey: A strategic progress report–part 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17075","last_updated":"2025-01-14T03:05:10Z","snapshot_observed_at":"2026-08-15T14:00:51.103815Z","submitted_at":"2024-11-26T03:27:43Z","title":"Don't Command, Cultivate: An Exploratory Study of System-2 Alignment","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T12:38:19.262867Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2411.17075"},"observation_digest":"sha256:65c253953a76cd47f71c3742078ddac59788a26226faa5ef2c7088c895a59d78","observation_id":"e2296d20-c191-423e-a7db-050e5dd5f548","resolution":{"observed_at":"2026-08-12T12:38:19.262867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-12T11:13:42.367173Z","title":"O1 replication journey: A strategic progress report–part 1,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18478","last_updated":"2025-06-02T14:26:19Z","snapshot_observed_at":"2026-08-21T04:21:52.295807Z","submitted_at":"2024-11-27T16:19:00Z","title":"Beyond Examples: High-level Automated Reasoning Paradigm in In-Context Learning via MCTS","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T11:13:42.367173Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2411.18478"},"observation_digest":"sha256:d492a5c82c6bc532387c9e838f8da07d5b1937b0636f36a045c50c90a4fca121","observation_id":"af52680b-0109-42a1-b44d-0d14b27359c0","resolution":{"observed_at":"2026-08-12T11:13:42.367173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-11T14:03:18.885861Z","title":"Advances in neural information processing systems, 35:27730–27744","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12583","last_updated":"2025-09-08T13:19:38Z","snapshot_observed_at":"2026-08-19T15:04:48.341360Z","submitted_at":"2024-12-17T06:24:34Z","title":"Process-Supervised Reward Models for Verifying Clinical Note Generation: A Scalable Approach Guided by Domain Expertise","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T14:03:18.885861Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2412.12583"},"observation_digest":"sha256:8264fdde4e980a8c2ede3723460ff7fc1615a684a7468ec5ec70f1a9e6497246","observation_id":"fbc91d87-fdc7-4ae0-96ea-3457ee901e3e","resolution":{"observed_at":"2026-08-11T14:03:18.885861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-11T11:40:13.712702Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15118","last_updated":"2025-06-06T12:13:42Z","snapshot_observed_at":"2026-08-17T11:16:52.279469Z","submitted_at":"2024-12-19T17:59:42Z","title":"Reasoning Through Execution: Unifying Process and Outcome Rewards for Code Generation","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T11:40:13.712702Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2412.15118"},"observation_digest":"sha256:73b5a7baf9cae3a2d7df9e6af535a894b53edc858dcbcfd75e7d62ca3f3e512d","observation_id":"2bd6778b-26b4-4a5b-8dd4-f8ae8b2183dc","resolution":{"observed_at":"2026-08-11T11:40:13.712702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-11T05:32:00.370371Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17498","last_updated":"2025-08-24T16:41:54Z","snapshot_observed_at":"2026-08-18T08:14:26.757106Z","submitted_at":"2024-12-23T11:55:33Z","title":"DRT: Deep Reasoning Translation via Long Chain-of-Thought","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T05:32:00.370371Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2412.17498"},"observation_digest":"sha256:13145be765d7fff2be9925dad4d286c6d710334a5b5ada21168e770a7cc72050","observation_id":"a2e42d08-de1c-4709-938a-a9d07cce0d1a","resolution":{"observed_at":"2026-08-11T05:32:00.370371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T12:36:50.060335Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2412.18925"},"observation_digest":"sha256:373d67a8ef804785ae80b663b316dfabf581972c5ddeaa56d1334c38cbca98df","observation_id":"8949b729-f708-4a48-918d-06351c144546","resolution":{"observed_at":"2026-05-15T12:36:50.238428Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-08-15T17:19:59.096854Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T17:36:27.515468Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2501.05366"},"observation_digest":"sha256:d846a31d9dcd82968e7ee3685b11d9f92f0fbdaf9dfe0203a104cb29b08a74d1","observation_id":"a2c26d62-487f-4dbd-a5db-97a4b8e51cce","resolution":{"observed_at":"2026-05-13T17:36:27.578579Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-05-15T21:20:59.128986Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2501.09686"},"observation_digest":"sha256:f55731bc1caa59a9c4da850d411cccbdd6d812ba18271d3806c60f7e96e03dd1","observation_id":"1215a215-26d3-4149-992f-242c007f4c14","resolution":{"observed_at":"2026-05-15T21:20:59.195715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-10T18:36:54.936546Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11223","last_updated":"2025-06-11T13:19:22Z","snapshot_observed_at":"2026-08-17T14:20:07.900972Z","submitted_at":"2025-01-20T02:16:19Z","title":"Reasoning Language Models: A Blueprint","version":4},"reference_index":123,"source":"pdf_text","source_observed_at":"2026-08-10T18:36:54.936546Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2501.11223"},"observation_digest":"sha256:7e0c36c71a04c96a76fadf3ee48d460aebc35de8547c6f402461b99f9ee51561","observation_id":"afd780c0-e976-4d4a-ba33-286272a6b206","resolution":{"observed_at":"2026-08-10T18:36:54.936546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-17T02:11:36.932541Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2502.03387"},"observation_digest":"sha256:8c9a857235ce3ec54aebf2086e4604af33b7269acd4788fb432ef71a6432c22e","observation_id":"289673d0-3f50-4387-9af6-f85cf2663bfd","resolution":{"observed_at":"2026-05-17T02:11:37.546358Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-09T00:27:17.655256Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04404","last_updated":"2025-02-06T08:52:43Z","snapshot_observed_at":"2026-08-20T19:48:27.155764Z","submitted_at":"2025-02-06T08:52:43Z","title":"Step Back to Leap Forward: Self-Backtracking for Boosting Reasoning of Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T00:27:17.655256Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2502.04404"},"observation_digest":"sha256:be220e41c439e0b9b95c35a1acccdedf2b4bfa9030a78d45133003458ee3f1b1","observation_id":"994c0b76-fd55-4067-8f67-28eb2457c620","resolution":{"observed_at":"2026-08-09T00:27:17.655256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-08T22:03:46.445142Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04644","last_updated":"2025-07-14T20:06:23Z","snapshot_observed_at":"2026-08-19T14:56:59.327123Z","submitted_at":"2025-02-07T04:08:46Z","title":"Agentic Reasoning: A Streamlined Framework for Enhancing LLM Reasoning with Agentic Tools","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T22:03:46.445142Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2502.04644"},"observation_digest":"sha256:bbfd3a8f198dcf06946bd7fd3f1c1e9c22b372b23021dd85cc1a0388827a7d40","observation_id":"91132f91-c429-4887-8366-b58a00b8def2","resolution":{"observed_at":"2026-08-08T22:03:46.445142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-08T21:45:45.387659Z","title":"O1 replication journey: A strategic progress report–part 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-15T02:02:52.968189Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.387659Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:64cc71a6a8b99b5392b43f738d0dd3e7d377b26b50d47303e4066bd1125027b3","observation_id":"654adc1e-7ed5-4d85-901d-6daa106d887e","resolution":{"observed_at":"2026-08-08T21:45:45.387659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-08T14:40:36.017882Z","title":"O1 replication journey: A strategic progress report--part 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-18T20:31:50.522103Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T14:40:36.017882Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2502.06703"},"observation_digest":"sha256:93b7cc3d0ea65235ce425cb832caedfeec10d7e02907d0f2a96962847564c4a5","observation_id":"25dd2f91-ba65-4050-8ee3-fe1df5e68c3c","resolution":{"observed_at":"2026-08-08T14:40:36.017882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-08T14:25:53.490904Z","title":"O1 replication journey: A strategic progress report--part 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06773","last_updated":"2025-02-10T18:52:04Z","snapshot_observed_at":"2026-08-13T11:53:50.444757Z","submitted_at":"2025-02-10T18:52:04Z","title":"On the Emergence of Thinking in LLMs I: Searching for the Right Intuition","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-08T14:25:53.490904Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2502.06773"},"observation_digest":"sha256:6decaaab79cf6c67ad55182683855bf55302f7b430d0c8b837fbf0159731b559","observation_id":"aa5ce6f6-2465-4fbc-9d8a-af09777caf75","resolution":{"observed_at":"2026-08-08T14:25:53.490904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T22:52:54.392447Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1 , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09042","last_updated":"2025-03-27T06:45:15Z","snapshot_observed_at":"2026-08-13T21:03:43.034767Z","submitted_at":"2025-02-13T07:55:54Z","title":"Typhoon T1: An Open Thai Reasoning Model","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T22:52:54.392447Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2502.09042"},"observation_digest":"sha256:74ec0a647229a7f90749bf4201c2f2b8119f5d96a424548ffaf564da332bd192","observation_id":"5c5fb550-2c52-465f-ab20-67fb06169bfd","resolution":{"observed_at":"2026-08-07T22:52:54.392447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-08T20:51:16.718723Z","title":"& Liu, P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10428","last_updated":"2025-04-05T13:51:05Z","snapshot_observed_at":"2026-08-18T02:12:46.829419Z","submitted_at":"2025-02-07T14:24:43Z","title":"Dynamic Chain-of-Thought: Towards Adaptive Deep Reasoning","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T20:51:16.718723Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2502.10428"},"observation_digest":"sha256:fa79b3d9dfd24946fe663f6bc7b4b9c2858eeebad8f6821541a51b1c8ad062e8","observation_id":"88419304-34b7-489b-87a3-160a07a81e7b","resolution":{"observed_at":"2026-08-08T20:51:16.718723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2502.17419","last_updated":"2025-06-25T02:24:46Z","snapshot_observed_at":"2026-08-20T08:13:05.630967Z","submitted_at":"2025-02-24T18:50:52Z","title":"From System 1 to System 2: A Survey of Reasoning Large Language Models","version":6},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T01:36:23.845366Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2502.17419"},"observation_digest":"sha256:644d2c056bf5f07db255740dd4dd7ddcb30f2677b53f2c9676bf15a8f14f26d5","observation_id":"22993868-7e67-49e7-9c5a-5a96bba0053c","resolution":{"observed_at":"2026-05-13T01:36:24.608929Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2503.17352","last_updated":"2025-11-11T08:13:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-21T17:52:43Z","title":"OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-19T06:59:03.112252Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2503.17352"},"observation_digest":"sha256:407d15d1df4e1c79a991c65987bef0b430aae504cfc61d6e2ca7626234fce04f","observation_id":"59a79e5e-ca81-42b3-9bf8-ff8b7c9ab3b0","resolution":{"observed_at":"2026-05-19T06:59:03.233406Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-16T12:02:43.679640Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13828","last_updated":"2025-04-28T12:41:07Z","snapshot_observed_at":"2026-08-18T03:47:57.203659Z","submitted_at":"2025-04-18T17:55:58Z","title":"Generative AI Act II: Test Time Scaling Drives Cognition Engineering","version":3},"reference_index":272,"source":"arxiv_source","source_observed_at":"2026-08-16T12:02:43.679640Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2504.13828"},"observation_digest":"sha256:99f8579e81f4964ca0f1bd43c5ba5aa4597a4968d772b200572d6a62deaf96e2","observation_id":"8943fddb-5947-4195-9026-d78d9f388374","resolution":{"observed_at":"2026-08-16T12:02:43.679640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2504.13958","last_updated":"2025-04-16T21:45:32Z","snapshot_observed_at":"2026-08-15T04:58:53.543603Z","submitted_at":"2025-04-16T21:45:32Z","title":"ToolRL: Reward is All Tool Learning Needs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-14T00:26:48.291431Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2504.13958"},"observation_digest":"sha256:9f5d888a8fdddb09799935e0afa174336a89fa96e02263f2e7b04ed959cb1476","observation_id":"84bc0180-a944-483a-9f67-666a3dec9ae3","resolution":{"observed_at":"2026-05-14T00:26:48.497341Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2504.21776","last_updated":"2025-10-13T12:40:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-30T16:25:25Z","title":"WebThinker: Empowering Large Reasoning Models with Deep Research Capability","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T19:14:25.283645Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2504.21776"},"observation_digest":"sha256:a3aae6d909a8624b9796a78d85248fb3349d12bda33587e2bd1675d2a85ad6e5","observation_id":"ee1597cd-1966-4b9e-97a2-1b54d068aae6","resolution":{"observed_at":"2026-05-16T19:14:25.402991Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-16T10:54:52.605395Z","title":"O1 replication jour- ney: A strategic progress report–part 1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.00016","last_updated":"2025-05-02T11:34:00Z","snapshot_observed_at":"2026-08-18T22:09:38.298930Z","submitted_at":"2025-04-23T19:02:04Z","title":"Sparks of Tabular Reasoning via Text2SQL Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T10:54:52.605395Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.00016"},"observation_digest":"sha256:6c66e6157baf2e6ce0f94dc573e98784c32b53b27e84df548b23ca8f97af9491","observation_id":"71a45054-a0e1-4fe6-9301-eb9f30de0d4e","resolution":{"observed_at":"2026-08-16T10:54:52.605395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-16T00:58:05.765285Z","title":"O1 replication journey: A strategic progress report– part 1.arXiv preprint arXiv:2410.18982,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.765285Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:1da7f3ef260483e5df1860b5be5dc61fccb0b973930a5a2f93db3f3b6d7b5aaf","observation_id":"4d3d3a5a-e09c-4cc0-b5bb-a76acac8de03","resolution":{"observed_at":"2026-08-16T00:58:05.765285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-15T23:56:46.276015Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03469","last_updated":"2025-05-21T06:17:56Z","snapshot_observed_at":"2026-08-20T14:00:28.683849Z","submitted_at":"2025-05-06T12:18:11Z","title":"Long-Short Chain-of-Thought Mixture Supervised Fine-Tuning Eliciting Efficient Reasoning in Large Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T23:56:46.276015Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.03469"},"observation_digest":"sha256:00a6d79c5b0d44079ca437a965061a9203a8e1a221390c7f627466cf73efc8bf","observation_id":"59a469f5-9a85-4d42-872c-d760af067d3a","resolution":{"observed_at":"2026-08-15T23:56:46.276015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-15T23:13:33.312069Z","title":"O1 replication journey: A strategic progress report–part 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05315","last_updated":"2025-05-21T05:40:27Z","snapshot_observed_at":"2026-08-18T03:20:04.325807Z","submitted_at":"2025-05-08T15:01:06Z","title":"Scalable Chain of Thoughts via Elastic Reasoning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:33.312069Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.05315"},"observation_digest":"sha256:69f9ad13fc729845cead112748352d3899301d5533265d51ceba380743571b60","observation_id":"76453cb6-ab27-4fb2-a1c0-6d1c1392b019","resolution":{"observed_at":"2026-08-15T23:13:33.312069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-15T21:14:45.785477Z","title":"O1 replication journey: A strategic progress report -- part 1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10475","last_updated":"2025-05-15T16:24:45Z","snapshot_observed_at":"2026-08-18T12:11:17.609605Z","submitted_at":"2025-05-15T16:24:45Z","title":"Parallel Scaling Law for Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T21:14:45.785477Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.10475"},"observation_digest":"sha256:a6e375c21bc9f3bab97bcc8bf3fd4941ee7d9e57251b2549c1ada404a6562b5b","observation_id":"1bc18ce3-73d5-4d44-8a5a-84a82dc7d135","resolution":{"observed_at":"2026-08-15T21:14:45.785477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T15:42:23.212775Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14107","last_updated":"2026-08-17T08:06:21Z","snapshot_observed_at":"2026-08-20T23:15:26.177310Z","submitted_at":"2025-05-20T09:14:53Z","title":"DiagnosisArena: Benchmarking Diagnostic Reasoning for Large Language Models","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:23.212775Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.14107"},"observation_digest":"sha256:f7f69f6b6b8a6d7770cb5760bff90b8576ec1d477e212a08a2c18eb6dd3c06a0","observation_id":"e0f2a2b3-80f0-445d-ad20-e698540706d5","resolution":{"observed_at":"2026-08-07T15:42:23.212775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T15:42:40.245671Z","title":"Samyam Rajbhandari, Conglong Li, Zhewei Yao, Min- jia Zhang, Reza Yazdani Aminabadi, Ammar Ah- mad Awan, Jeff Rasley, and Yuxiong He","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14173","last_updated":"2025-05-20T10:27:19Z","snapshot_observed_at":"2026-08-18T00:47:26.957853Z","submitted_at":"2025-05-20T10:27:19Z","title":"THOR-MoE: Hierarchical Task-Guided and Context-Responsive Routing for Neural Machine Translation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.245671Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.14173"},"observation_digest":"sha256:0e31f9a39825d88a703b7cdb680af8daab6b8541424212c105b7c18944f894df","observation_id":"cca941a6-7dfc-4252-aaf5-127ec6ba9e79","resolution":{"observed_at":"2026-08-07T15:42:40.245671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T15:06:06.440420Z","title":"O1 replication journey: A strategic progress report–part 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16410","last_updated":"2025-05-22T09:00:19Z","snapshot_observed_at":"2026-08-17T08:52:56.038060Z","submitted_at":"2025-05-22T09:00:19Z","title":"Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:06.440420Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.16410"},"observation_digest":"sha256:db1d1618417b103b6553c03155213fb33000a5d1d453f9b4caf18ff1e675e407","observation_id":"0adb45c0-3add-4d97-9c99-26536730064d","resolution":{"observed_at":"2026-08-07T15:06:06.440420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T14:41:35.110924Z","title":"O1 replication journey: A strategic progress report–part 1,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-17T20:21:27.215386Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:35.110924Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:96b4d6461439fcfcc5029c6ee1f0573e01cf6689630cf369585519cdba310cdc","observation_id":"ddff6edb-6561-415f-a0be-7db1e94857ea","resolution":{"observed_at":"2026-08-07T14:41:35.110924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T14:39:15.669194Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18105","last_updated":"2025-05-23T17:02:02Z","snapshot_observed_at":"2026-08-17T05:40:21.549119Z","submitted_at":"2025-05-23T17:02:02Z","title":"ManuSearch: Democratizing Deep Search in Large Language Models with a Transparent and Open Multi-Agent Framework","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:15.669194Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.18105"},"observation_digest":"sha256:cbb36637641b325026757d858a2b80e3b40e60b43e5f2d87eb3f8d27ad3fd251","observation_id":"8be07af9-7085-4b03-a54c-900c6476ec1a","resolution":{"observed_at":"2026-08-07T14:39:15.669194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T14:13:08.930615Z","title":"O1 replication journey: A strategic progress report - part 1.CoRR, abs/2410.18982, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19815","last_updated":"2025-05-26T10:52:17Z","snapshot_observed_at":"2026-08-14T19:11:50.543978Z","submitted_at":"2025-05-26T10:52:17Z","title":"Deciphering Trajectory-Aided LLM Reasoning: An Optimization Perspective","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:08.930615Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.19815"},"observation_digest":"sha256:4096086d21cbe9b31abc5d26987997498b33c26ec2133317b892a658f65f1d46","observation_id":"c47a79b1-30cf-4b43-a5c0-f515f443b4e2","resolution":{"observed_at":"2026-08-07T14:13:08.930615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T14:07:48.828230Z","title":"O1 replication journey: A strategic progress report–part 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19949","last_updated":"2025-05-26T13:15:26Z","snapshot_observed_at":"2026-08-20T03:49:01.362977Z","submitted_at":"2025-05-26T13:15:26Z","title":"Which Data Attributes Stimulate Math and Code Reasoning? An Investigation via Influence Functions","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:07:48.828230Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.19949"},"observation_digest":"sha256:ab334bcb34cde71a3d54f3bc373efe2d7db38870f6c27814dc252fe49d3c3716","observation_id":"226526dd-0686-47ca-ae8f-4bf3a708b26f","resolution":{"observed_at":"2026-08-07T14:07:48.828230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T13:43:10.814786Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21172","last_updated":"2025-05-27T13:26:02Z","snapshot_observed_at":"2026-08-18T08:14:28.198712Z","submitted_at":"2025-05-27T13:26:02Z","title":"TAT-R1: Terminology-Aware Translation with Reinforcement Learning and Word Alignment","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:43:10.814786Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.21172"},"observation_digest":"sha256:a5039d5ca24fc0861a766017e8aa55be9ca738d2b5084c8003d4e5027b9b9891","observation_id":"1f7a1448-9caa-4e79-865a-4df6ba198dd8","resolution":{"observed_at":"2026-08-07T13:43:10.814786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T12:53:02.180756Z","title":"O1 replication journey: A strategic progress report--part 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23363","last_updated":"2025-05-29T11:40:34Z","snapshot_observed_at":"2026-08-13T15:07:02.007842Z","submitted_at":"2025-05-29T11:40:34Z","title":"Discriminative Policy Optimization for Token-Level Reward Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:53:02.180756Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.23363"},"observation_digest":"sha256:474b4d7ab72f3e9fbae5b330ab6fb84c9ce07f75f9b352500a421704dd2c134b","observation_id":"2f5a6936-3892-45ca-925a-64d68330879a","resolution":{"observed_at":"2026-08-07T12:53:02.180756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T11:55:13.434001Z","title":"O1 replication journey: A strategic progress report–part 1.arXiv preprint arXiv:2410.18982, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01078","last_updated":"2025-06-01T16:28:26Z","snapshot_observed_at":"2026-08-17T06:45:11.512822Z","submitted_at":"2025-06-01T16:28:26Z","title":"GThinker: Towards General Multimodal Reasoning via Cue-Guided Rethinking","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:13.434001Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2506.01078"},"observation_digest":"sha256:692154800aab484f9f5df89a13f7d679c60d45a92c74c63d317e110ed6308d5d","observation_id":"7f4e8530-e3d7-4994-a8a2-82b77e6730e9","resolution":{"observed_at":"2026-08-07T11:55:13.434001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T06:07:02.055033Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06009","last_updated":"2025-06-06T11:54:06Z","snapshot_observed_at":"2026-08-17T17:43:46.269354Z","submitted_at":"2025-06-06T11:54:06Z","title":"Unlocking Recursive Thinking of LLMs: Alignment via Refinement","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:02.055033Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2506.06009"},"observation_digest":"sha256:11ca33ae523dd6200a1e0dc53e0e49cc9eeba6324f604623074e1ec74604e4c7","observation_id":"2d7ca1f7-6c45-49c7-8011-f26477e5e3b3","resolution":{"observed_at":"2026-08-07T06:07:02.055033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2506.11989","last_updated":"2026-05-01T04:52:44Z","snapshot_observed_at":"2026-08-18T08:14:24.415413Z","submitted_at":"2025-06-13T17:46:14Z","title":"Thought Graph Traversal for Test-time Scaling in Chest X-ray VLLMs","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T09:15:46.135084Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2506.11989"},"observation_digest":"sha256:191f460efee9cc8b1a56d632a96632eb4003bd20de23d490718c0166677e5506","observation_id":"3583c1e9-3f48-4c8b-bd63-f60e89578f0d","resolution":{"observed_at":"2026-05-19T09:17:13.977702Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-15T18:55:51.083275Z","title":"QwenTeam","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18330","last_updated":"2025-06-25T10:49:23Z","snapshot_observed_at":"2026-08-21T07:05:29.659683Z","submitted_at":"2025-06-23T06:23:53Z","title":"Confucius3-Math: A Lightweight High-Performance Reasoning LLM for Chinese K-12 Mathematics Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:55:51.083275Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2506.18330"},"observation_digest":"sha256:7ae134067449d14e6bf9e45ebb27e5fd63f29245ae7467e1d5e4a1ff4b626937","observation_id":"89da2d77-6780-4772-a51a-bf55b651bd75","resolution":{"observed_at":"2026-08-15T18:55:51.083275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-06T22:23:11.516566Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22521","last_updated":"2025-06-26T22:02:01Z","snapshot_observed_at":"2026-08-17T10:14:30.703303Z","submitted_at":"2025-06-26T22:02:01Z","title":"A Survey on Model Extraction Attacks and Defenses for Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:11.516566Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2506.22521"},"observation_digest":"sha256:c4847c3322723e00ebedc39824fe66981e9b6a9bbc82b45f70a16904cc7a0c2b","observation_id":"ee4f3b3a-defe-405c-883d-5f473e192fab","resolution":{"observed_at":"2026-08-06T22:23:11.516566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-06T18:12:59.282290Z","title":"O1 replication journey: A strategic progress report–part 1.arXiv preprint arXiv:2410.18982, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08960","last_updated":"2025-07-11T18:34:07Z","snapshot_observed_at":"2026-08-20T07:16:23.560280Z","submitted_at":"2025-07-11T18:34:07Z","title":"How to Train a Leader: Hierarchical Reasoning in Multi-Agent LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:12:59.282290Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2507.08960"},"observation_digest":"sha256:329038b34316ad62925ba051d619de7b503619451b2961ebf602457840091f2c","observation_id":"fcab31e2-8508-4fe2-9861-2d58435f8910","resolution":{"observed_at":"2026-08-06T18:12:59.282290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-06T15:50:51.208072Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14849","last_updated":"2025-07-20T07:43:16Z","snapshot_observed_at":"2026-08-19T18:01:11.312974Z","submitted_at":"2025-07-20T07:43:16Z","title":"Beyond Isolated Capabilities: Bridging Long CoT Reasoning and Long-Context Understanding","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T15:50:51.208072Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2507.14849"},"observation_digest":"sha256:8f3971014583fc8f1b08e4ee00734882b9897169a699fc7c77b84750364be290","observation_id":"b8caf060-27c4-413a-b1b9-77cfc1303792","resolution":{"observed_at":"2026-08-06T15:50:51.208072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2507.15698","last_updated":"2026-05-19T07:11:43Z","snapshot_observed_at":"2026-08-17T08:15:54.100360Z","submitted_at":"2025-07-21T15:07:59Z","title":"CoLD: Counterfactually-Guided Length Debiasing for Process Reward Models in Mathematical Reasoning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T23:24:43.556606Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2507.15698"},"observation_digest":"sha256:ca7f59c7b223da4df3a52bbac10f88326bc7cb5419bd2e244ea56967bb1b0b3f","observation_id":"8d9cd287-48e2-4169-96c8-fb4ab79daf80","resolution":{"observed_at":"2026-05-21T23:25:45.349208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-15T18:22:13.256368Z","title":"O1 replication journey: A strategic progress report–part 1,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18178","last_updated":"2025-07-24T08:24:52Z","snapshot_observed_at":"2026-08-18T23:14:26.417163Z","submitted_at":"2025-07-24T08:24:52Z","title":"Decoupling Knowledge and Reasoning in LLMs: An Exploration Using Cognitive Dual-System Theory","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:22:13.256368Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2507.18178"},"observation_digest":"sha256:fda90f6c3a988a1f351c4a8e30e9ea1e1ae4a8b4aa9fcd60202e40422abdfb90","observation_id":"d730a4a7-c698-48cf-9285-c0fd4eb7a813","resolution":{"observed_at":"2026-08-15T18:22:13.256368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-05T23:36:22.055417Z","title":"O1 replication journey: A strategic progress report--part 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05081","last_updated":"2025-08-07T07:05:22Z","snapshot_observed_at":"2026-08-17T15:40:37.498168Z","submitted_at":"2025-08-07T07:05:22Z","title":"Cognitive Duality for Adaptive Web Agents","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T23:36:22.055417Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2508.05081"},"observation_digest":"sha256:049f7d03bfcecd35641457e7fbcc24c56b2350b396ccb827a4cca7c9ac0a329b","observation_id":"3bdf99f3-2c80-41cc-8a8a-bee263f8a5fa","resolution":{"observed_at":"2026-08-05T23:36:22.055417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2509.02547","last_updated":"2026-04-17T18:09:08Z","snapshot_observed_at":"2026-08-03T09:07:42.489237Z","submitted_at":"2025-09-02T17:46:26Z","title":"The Landscape of Agentic Reinforcement Learning for LLMs: A Survey","version":5},"reference_index":186,"source":"pdf_text","source_observed_at":"2026-05-18T19:19:36.427337Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2509.02547"},"observation_digest":"sha256:c6616ec1d63db2e7b608cff5ddbaaf2b73b80781ad7b6d0e562152bc00dd104c","observation_id":"77f92f80-5b45-4dfb-ab0c-44c68e38d6b9","resolution":{"observed_at":"2026-05-18T19:21:48.787609Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-05T10:38:59.862669Z","title":"O1 Replication Journey: A Strategic Progress Report–Part 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-17T17:37:38.616375Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:38:59.862669Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:550357e0814749ee2b88cc3491ef9c5ae751a129134d78c092175840d509d746","observation_id":"54025218-799b-439d-b3b8-6be341fb747c","resolution":{"observed_at":"2026-08-05T10:38:59.862669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-04T23:33:42.000535Z","title":"O1 replication journey: A strategic progress report - part 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06524","last_updated":"2025-09-08T10:30:58Z","snapshot_observed_at":"2026-08-16T02:46:12.661756Z","submitted_at":"2025-09-08T10:30:58Z","title":"LAMDAS: LLM as an Implicit Classifier for Domain-specific Data Selection","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T23:33:42.000535Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2509.06524"},"observation_digest":"sha256:613ae4f747364894f35b59c81b167f3bafe75dc90ea38ea4aeee08d0a2d67851","observation_id":"acc2dabf-d3ea-449f-9358-ffe2e6ef2a66","resolution":{"observed_at":"2026-08-04T23:33:42.000535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2605.08401","last_updated":"2026-05-15T12:46:04Z","snapshot_observed_at":"2026-08-11T06:44:47.502612Z","submitted_at":"2026-05-08T19:06:55Z","title":"AIPO: Learning to Reason from Active Interaction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-12T01:17:28.124867Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2605.08401"},"observation_digest":"sha256:a222fe49d805e971213697c6ca774fdde969160cfefa14537418acf6b9a39815","observation_id":"362dd49c-e6ae-4bcf-ad29-302e6ba8dfa4","resolution":{"observed_at":"2026-05-12T08:06:31.700346Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2605.08401","last_updated":"2026-05-15T12:46:04Z","snapshot_observed_at":"2026-08-11T06:44:47.502612Z","submitted_at":"2026-05-08T19:06:55Z","title":"AIPO: Learning to Reason from Active Interaction","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-19T18:07:27.492419Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2605.08401"},"observation_digest":"sha256:7f200ac6d641a6d5c30e46d4cf852a2fc640fb8c6bdebf1a2a408d538aaad6f6","observation_id":"6642f3fb-148e-4fc8-a0aa-5eda8559c7a4","resolution":{"observed_at":"2026-05-19T18:07:42.310933Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2606.07020","last_updated":"2026-06-05T08:09:46Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T08:09:46Z","title":"MADE: Beyond Scoring via a Multilingual Agentic Diagnosing Engine for Fine-Grained Evaluation Insights","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-27T22:16:42.836058Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2606.07020"},"observation_digest":"sha256:33aadfc1b0c315eaf4e4c9b3743e2930270ddd54cb7ae6198fd543962eb52963","observation_id":"e3d227e9-db3c-404e-b0c8-729919741a87","resolution":{"observed_at":"2026-07-02T16:57:09.849222Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":"2410.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-07-04T11:09:46.422756Z","title":"Ram´e, A.; Ferret, J.; Vieillard, N.; Dadashi, R.; Hussenot, L.; Cedoz, P.-L.; Sessa, P","venue":null,"work_id":"0738313f-d0cc-4548-a3bc-eba0fa2d607b","year":2024},"citing_paper":{"arxiv_id":"2606.24937","last_updated":"2026-07-27T15:17:17Z","snapshot_observed_at":"2026-08-20T13:10:26.183805Z","submitted_at":"2026-06-22T17:48:54Z","title":"The Hitchhiker's Guide to Agentic AI: From Foundations to Systems","version":1},"reference_index":263,"source":"pdf_text","source_observed_at":"2026-06-26T08:09:57.542558Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2606.24937"},"observation_digest":"sha256:158f4766df02a0a3e2b741ea92ec59cf974191d6c16a662b63caaded85bf33ac","observation_id":"9a7f20ad-195c-471b-9e9b-54f32a386a21","resolution":{"observed_at":"2026-07-04T11:09:46.426975Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-02T10:27:18.616327Z","title":"O1 Replication Journey: A Strategic Progress Report.arXiv Preprint arXiv:2410.18982, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.24937","last_updated":"2026-07-27T15:17:17Z","snapshot_observed_at":"2026-08-20T13:10:26.183805Z","submitted_at":"2026-06-22T17:48:54Z","title":"The Hitchhiker's Guide to Agentic AI: From Foundations to Systems","version":2},"reference_index":263,"source":"pdf_text","source_observed_at":"2026-08-02T10:27:18.616327Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2606.24937"},"observation_digest":"sha256:5595b3199a5db299f7c0fa79f24babf3197cca4908ed46315e7d234942fd82e5","observation_id":"606e70da-df3e-4931-8af5-174cabf12691","resolution":{"observed_at":"2026-08-02T10:27:18.616327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-02T01:52:30.041159Z","title":"arXiv preprint arXiv:2410.18982 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14552","last_updated":"2026-07-16T04:28:19Z","snapshot_observed_at":"2026-08-15T06:42:39.717073Z","submitted_at":"2026-07-16T04:28:19Z","title":"Answer-Conditioned Chains of Thought Degrade Verifiable-Reasoning Distillation in Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T01:52:30.041159Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2607.14552"},"observation_digest":"sha256:6a5e0716a6654f8312eb09a60373059a78c56ef0a78cd688f704484d938c5b87","observation_id":"13f33345-a82a-4a91-ad35-95010d2f1d58","resolution":{"observed_at":"2026-08-02T01:52:30.041159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-12T14:10:45.505387Z","title":"arXiv preprint arXiv:2410.18982 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10928","last_updated":"2026-08-11T13:58:07Z","snapshot_observed_at":"2026-08-17T15:17:05.825896Z","submitted_at":"2026-08-11T13:58:07Z","title":"ThinkRetrieve: Retrieval-Augmented Reasoning Traces for Test-Time Scaling","version":1},"reference_index":131,"source":"arxiv_source","source_observed_at":"2026-08-12T14:10:45.505387Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2608.10928"},"observation_digest":"sha256:df73d1a6fe82a1b3c53181f437059025167ebca9d99f9026bd074ee4eb045327","observation_id":"a04551ab-739c-444d-9a93-ccf9b4c5ee93","resolution":{"observed_at":"2026-08-12T14:10:45.505387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.18982/citation-record","integrity":"/paper/2410.18982/integrity","json":"/paper/2410.18982/citation-record.json","paper":"/paper/2410.18982"},"outbound":[],"paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 59 inbound Pith citation observations for arXiv:2410.18982."}