{"as_of":"2026-08-14T12:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:002b2b8b757f6561e62b777a4c8fefc6d85f5116c2b5c4d1eb75deeb7b75337f","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T05:58:55.232552Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:05:48.244094Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T17:12:25.259204Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2412.16964","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.16964","snapshot_observed_at":"2026-06-28T17:12:25.259204Z","title":"System-2 mathematical reasoning via enriched instruction tuning","venue":null,"work_id":"991fe019-d662-4056-90b2-9ca819a771c8","year":2024},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2412.16964","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:845c337f31459b87271b42121bc6adfeb1002db446274ba9562674ba731ff6ac","observation_id":"752786e5-54b0-41a6-9fbf-dd9a61e0f212","resolution":{"observed_at":"2026-05-12T08:40:41.245411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2412.16964","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.16964","snapshot_observed_at":"2026-06-28T17:12:25.259204Z","title":"System-2 mathematical reasoning via enriched instruction tuning","venue":null,"work_id":"991fe019-d662-4056-90b2-9ca819a771c8","year":2024},"citing_paper":{"arxiv_id":"2606.01168","last_updated":"2026-05-31T11:20:00Z","snapshot_observed_at":"2026-08-12T06:37:36.358906Z","submitted_at":"2026-05-31T11:20:00Z","title":"Thinking Economically: A Hierarchical Framework for Adaptive-Complexity Reasoning in LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-28T17:05:48.244094Z"},"links":{"cited_paper":"/paper/2412.16964","citing_paper":"/paper/2606.01168"},"observation_digest":"sha256:17168a23339f886d5586cc14a715b555984723081957dc9a18eee5afd8a42442","observation_id":"414c16ba-13b0-4500-8365-27bda7d9ef28","resolution":{"observed_at":"2026-06-28T17:12:25.260632Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.16964/citation-record","integrity":"/paper/2412.16964/integrity","json":"/paper/2412.16964/citation-record.json","paper":"/paper/2412.16964"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:54.922392Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.922392Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:6655000170d4eff6a24b7280074010f29a6da061cdcbf1a63ac131dffa23366e","observation_id":"a55b3931-e70f-4c2f-ac8b-b8a73f79b34f","resolution":{"observed_at":"2026-08-11T05:58:54.922392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:54.928737Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.928737Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:f656de82dda9d096015eb613d07c1e30986c0e114fd87abf20a072169134171e","observation_id":"cbbed844-b9b1-4d75-b9d9-51f35073b526","resolution":{"observed_at":"2026-08-11T05:58:54.928737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T05:58:54.934374Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.934374Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:b7420879468fd34448fa3b86268d33e7c1e470492d689638bc497f74a9ad3dbe","observation_id":"558eb688-8965-4f7a-9dc1-1ab30b6a765f","resolution":{"observed_at":"2026-08-11T05:58:54.934374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10631","last_updated":"2024-03-15T19:14:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-16T17:54:07Z","title":"Llemma: An Open Language Model For Mathematics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10631","snapshot_observed_at":"2026-08-11T05:58:54.945600Z","title":"Jiang, Jia Deng, Stella Biderman, and Sean Welleck","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.945600Z"},"links":{"cited_paper":"/paper/2310.10631","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:203dfd83580faa8503f4e3b29f15abe8241674b0718daf3deeaf273fc0b0337e","observation_id":"2c449c02-6f8d-473e-be46-841a65c61f27","resolution":{"observed_at":"2026-08-11T05:58:54.945600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-10T17:03:38.042994Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-11T05:58:54.950636Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.950636Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:43d9da00fe0297cfa80ae19a6ba67275f8d2596b2ccf965d4bc4ad410c1a8112","observation_id":"c738cf5a-996e-46cc-be94-52024b1e7b07","resolution":{"observed_at":"2026-08-11T05:58:54.950636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08147","last_updated":"2024-05-24T14:51:14Z","snapshot_observed_at":"2026-08-13T04:20:09.196587Z","submitted_at":"2024-02-13T00:55:14Z","title":"VerMCTS: Synthesizing Multi-Step Programs using a Verifier, a Large Language Model, and Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08147","snapshot_observed_at":"2026-08-11T05:58:54.956194Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.956194Z"},"links":{"cited_paper":"/paper/2402.08147","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:d84f8c2bf49ecc2c824708c1aacf79be548d5df51bcbad7916ac3dea2ec27c20","observation_id":"844e4dbe-6aef-455f-baa5-16e14de94b91","resolution":{"observed_at":"2026-08-11T05:58:54.956194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-11T05:58:54.961904Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.961904Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:6bafdab9ef92bb0772d64743f5c15fd3a34eb356a0cb16dc214faca86e2a2b0e","observation_id":"462edb99-56b0-4f08-b2a2-3ab34c1da5ce","resolution":{"observed_at":"2026-08-11T05:58:54.961904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T05:58:54.968023Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.968023Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:3732e03c9658ec0d6835344ae40e2482d51bb768d3dc315ec2ae926e7ea30b7b","observation_id":"348be9ca-24f5-4713-965a-332a8a94f450","resolution":{"observed_at":"2026-08-11T05:58:54.968023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-11T05:58:54.973777Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.973777Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:cb2968fb639813d8056d1eb39dccb7077a233a0078db87e4eba7b6913ade7d10","observation_id":"dc5432ed-ea4d-4cf6-9bba-c33032535fe1","resolution":{"observed_at":"2026-08-11T05:58:54.973777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10890","last_updated":"2024-06-06T14:55:40Z","snapshot_observed_at":"2026-08-13T04:17:20.751499Z","submitted_at":"2024-02-16T18:45:58Z","title":"When is Tree Search Useful for LLM Planning? It Depends on the Discriminator","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10890","snapshot_observed_at":"2026-08-11T05:58:54.978726Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.978726Z"},"links":{"cited_paper":"/paper/2402.10890","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:a30968d437788c7157f804279b829376599ded224ef7650985978a549f34b923","observation_id":"af91cf21-96d0-4cb7-b468-6b50eddc7cee","resolution":{"observed_at":"2026-08-11T05:58:54.978726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:54.984106Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.984106Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:aecd1b54077cbf2dd34b910b8a845db60ada915891b92b8dcb10d88d50890fd0","observation_id":"0e0215a4-2460-4814-b740-dea1cb328111","resolution":{"observed_at":"2026-08-11T05:58:54.984106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T05:58:54.989174Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.989174Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:0c7304b019e6421bbf54c6ec4d85eb4cf89869903015b8ac44c10fbe34464f45","observation_id":"cca3a919-0996-442f-82c3-ddc1d4f26183","resolution":{"observed_at":"2026-08-11T05:58:54.989174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:54.994529Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.994529Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:81a4352d7ee305ec73d3f263a78a0d543c38fbae1918115d06534ea3bf9f92d8","observation_id":"6e9dd4f8-18fb-4de0-8a5e-ceab7fad667a","resolution":{"observed_at":"2026-08-11T05:58:54.994529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:56.125216Z","title":null,"venue":null,"work_id":"273c005d-09fe-4049-bac2-5343e979074b","year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:54.999534Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:d96c3216b29111e14c1298bc2a6898c5142fb082b9562f57a7317782d27c7ba0","observation_id":"b6d78602-d44c-47ae-9c56-691eb35575c6","resolution":{"observed_at":"2026-08-11T05:58:56.130256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10735","last_updated":"2025-02-08T11:45:10Z","snapshot_observed_at":"2026-08-13T00:56:21.770701Z","submitted_at":"2024-10-14T17:16:44Z","title":"Embedding Self-Correction as an Inherent Ability in Large Language Models for Enhanced Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10735","snapshot_observed_at":"2026-08-11T05:58:55.004697Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.004697Z"},"links":{"cited_paper":"/paper/2410.10735","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:c9df8932a76174ca19dd3727e81fb9b4e262f0f5fa374c3c206e1dbeedf2afd9","observation_id":"87c82c2e-43e4-4385-b05e-ec209c72fdae","resolution":{"observed_at":"2026-08-11T05:58:55.004697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17452","last_updated":"2024-02-21T12:59:22Z","snapshot_observed_at":"2026-08-13T21:12:04.800343Z","submitted_at":"2023-09-29T17:59:38Z","title":"ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17452","snapshot_observed_at":"2026-08-11T05:58:55.010034Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.010034Z"},"links":{"cited_paper":"/paper/2309.17452","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:86bc1598170ec81f0c819c80b2b0e988b89b51bbb3b7ad6f718d9b5ab0ab34e7","observation_id":"0fd705c3-2c68-425d-b687-7ccd0ff8252c","resolution":{"observed_at":"2026-08-11T05:58:55.010034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05206","last_updated":"2023-08-02T09:24:23Z","snapshot_observed_at":"2026-08-13T13:24:20.297075Z","submitted_at":"2022-12-10T05:07:30Z","title":"Thinking Fast and Slow in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05206","snapshot_observed_at":"2026-08-11T05:58:55.015663Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.015663Z"},"links":{"cited_paper":"/paper/2212.05206","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:39099134ec0f5bfd761c8583952466ec6fe41092a199bd762a5d6611d0c4057b","observation_id":"faa24726-3694-4b6f-8588-17c4fa929a17","resolution":{"observed_at":"2026-08-11T05:58:55.015663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-11T05:58:55.020637Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.020637Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:6c6a6bf58b387ad890adaebdd536521bdca20d1fbf1d6b7b954eafd5e46011d8","observation_id":"61c03db9-c3a0-483c-b047-cd4b5061145e","resolution":{"observed_at":"2026-08-11T05:58:55.020637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02775","last_updated":"2023-12-18T23:23:06Z","snapshot_observed_at":"2026-08-13T05:32:32.734727Z","submitted_at":"2023-11-05T21:43:02Z","title":"AI-TA: Towards an Intelligent Question-Answer Teaching Assistant using Open-Source LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.02775","snapshot_observed_at":"2026-08-11T05:58:55.025800Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.025800Z"},"links":{"cited_paper":"/paper/2311.02775","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:023216416b2b09f62430edfa37eed513e2a49a074765e4e3260497bf1e88eba2","observation_id":"15385937-2fb8-4e7d-ba69-53fe64ecbea4","resolution":{"observed_at":"2026-08-11T05:58:55.025800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:55.031232Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.031232Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:dba9bfe071fb3a6a723480960c35971c676999588f88bef4887da9d25ed30b02","observation_id":"a5f50e5b-ffc3-4270-9ee4-07fcdbc22527","resolution":{"observed_at":"2026-08-11T05:58:55.031232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04925","last_updated":"2024-06-22T08:18:48Z","snapshot_observed_at":"2026-08-13T04:45:32.719820Z","submitted_at":"2024-01-10T04:37:38Z","title":"The Impact of Reasoning Step Length on Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04925","snapshot_observed_at":"2026-08-11T05:58:55.036537Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.036537Z"},"links":{"cited_paper":"/paper/2401.04925","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:d28e6a4243b35101c6fe9d4493948cac7e2587f60d36ad37ecc6653e3036e8a9","observation_id":"7d37e4fe-4860-4420-90d2-9b35f06f2d5f","resolution":{"observed_at":"2026-08-11T05:58:55.036537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:56.098866Z","title":null,"venue":null,"work_id":"1b4f26b9-fcac-41bc-80fa-49e3f41ca53c","year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.041747Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:e2d8d1735f19b7385c08423c4c00a9b5db10b7701ee90057c9194b078cc9fca9","observation_id":"b31cb285-80e3-4267-9a88-5b7731750c7e","resolution":{"observed_at":"2026-08-11T05:58:56.103700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-11T05:58:55.046506Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.046506Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:16204d22ed0e5b81cdc02c2ffcf66855b06fb7305ce9dbfdd7c9f3dd5b984270","observation_id":"3b6c2239-59d8-4510-8180-3844c6c76a14","resolution":{"observed_at":"2026-08-11T05:58:55.046506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-11T05:58:55.051638Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.051638Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:3a40f56903a89839a662f661ddf9f99b26f679abd8c84e4b99a3c4d185a57976","observation_id":"6bc9210e-8220-44ee-8a02-a91ab69a907f","resolution":{"observed_at":"2026-08-11T05:58:55.051638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:56.081636Z","title":null,"venue":null,"work_id":"ce25dfa7-1325-4937-8f81-ff1c868ad455","year":2022},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.056728Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:77b9f3250860b2816e057002b2d1aab196457d3bc1b2a6b7459cf0fd0b0724c1","observation_id":"68e0126e-1c92-4474-9ac4-23af33348074","resolution":{"observed_at":"2026-08-11T05:58:56.087440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00267","last_updated":"2024-09-03T14:01:54Z","snapshot_observed_at":"2026-07-06T16:13:07.384791Z","submitted_at":"2023-09-01T05:53:33Z","title":"RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00267","snapshot_observed_at":"2026-08-11T05:58:55.061657Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.061657Z"},"links":{"cited_paper":"/paper/2309.00267","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:b6d4c147ef16e4b61c9a5d674f4c286c0381a8dec0924e6e61968470905b967f","observation_id":"1f3ed196-84ba-4939-882e-fec9e786c2e9","resolution":{"observed_at":"2026-08-11T05:58:55.061657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09241","last_updated":"2023-12-14T18:58:28Z","snapshot_observed_at":"2026-08-14T06:20:13.018887Z","submitted_at":"2023-12-14T18:58:28Z","title":"TinyGSM: achieving >80% on GSM8k with small language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09241","snapshot_observed_at":"2026-08-11T05:58:55.066821Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.066821Z"},"links":{"cited_paper":"/paper/2312.09241","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:0cc65abb9df09aa67b19a4012ba813da7b16b6cfa31057e28ae27bc1a31f97cf","observation_id":"72361e13-963d-4b7a-b88c-1dee1cede574","resolution":{"observed_at":"2026-08-11T05:58:55.066821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10535","last_updated":"2023-06-22T01:37:02Z","snapshot_observed_at":"2026-08-13T13:17:52.031804Z","submitted_at":"2022-12-20T18:46:16Z","title":"A Survey of Deep Learning for Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10535","snapshot_observed_at":"2026-08-11T05:58:55.071925Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.071925Z"},"links":{"cited_paper":"/paper/2212.10535","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:60a804e4ee4502bf74d902ca51b692934f81502e3bdcf5edad5e8437bc41d14a","observation_id":"93d20052-1d88-4b03-8252-6c3a9c4878e3","resolution":{"observed_at":"2026-08-11T05:58:55.071925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16352","last_updated":"2024-09-11T08:23:58Z","snapshot_observed_at":"2026-08-13T04:10:19.092794Z","submitted_at":"2024-02-26T07:17:25Z","title":"MathGenie: Generating Synthetic Data with Question Back-translation for Enhancing Mathematical Reasoning of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16352","snapshot_observed_at":"2026-08-11T05:58:55.077285Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.077285Z"},"links":{"cited_paper":"/paper/2402.16352","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:13c1fb273687ade4b876fe43e2d0740c4e200ca8b77fff5fa57a7c64bb0b1318","observation_id":"ebd885ec-f794-463b-a8a0-ac131827537d","resolution":{"observed_at":"2026-08-11T05:58:55.077285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09583","last_updated":"2025-06-04T08:58:56Z","snapshot_observed_at":"2026-08-02T06:48:43.121988Z","submitted_at":"2023-08-18T14:23:21Z","title":"WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09583","snapshot_observed_at":"2026-08-11T05:58:55.082730Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.082730Z"},"links":{"cited_paper":"/paper/2308.09583","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:9f7c7be79e2ac8e7719dad17f93720c0976b9708bed2fec7f29a88437c673a94","observation_id":"6829a5b9-a378-4a54-acb9-bea70a213d6e","resolution":{"observed_at":"2026-08-11T05:58:55.082730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-13T10:17:41.024765Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-11T05:58:55.087761Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.087761Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:5450d712f2b7843e9e1ad04a992777f409178b496dccb78757c9e0e7d5f4eba8","observation_id":"453d06d9-319c-4d7b-a7d8-02d1144bb7c6","resolution":{"observed_at":"2026-08-11T05:58:55.087761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14830","last_updated":"2024-02-16T23:44:38Z","snapshot_observed_at":"2026-08-13T23:44:54.604004Z","submitted_at":"2024-02-16T23:44:38Z","title":"Orca-Math: Unlocking the potential of SLMs in Grade School Math","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14830","snapshot_observed_at":"2026-08-11T05:58:55.093376Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.093376Z"},"links":{"cited_paper":"/paper/2402.14830","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:8f79a22ae766be11d8a7ee0bb8d0c037578ade0527424684f6a6f34bf387cd48","observation_id":"e62c0bb0-a481-4949-8676-b94e2c0157a0","resolution":{"observed_at":"2026-08-11T05:58:55.093376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:55.098686Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.098686Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:eb7bbe4dea5f00323a66895fa5d7857a5d2776410eafb6b0c46dfcdeb9b1e269","observation_id":"dd08e71f-d6c7-4875-b978-57bb644d2ad5","resolution":{"observed_at":"2026-08-11T05:58:55.098686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01116","last_updated":"2023-06-01T20:03:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T20:03:56Z","title":"The RefinedWeb Dataset for Falcon LLM: Outperforming Curated Corpora with Web Data, and Web Data Only","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01116","snapshot_observed_at":"2026-08-11T05:58:55.103299Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.103299Z"},"links":{"cited_paper":"/paper/2306.01116","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:36df0aae8d8f178d4a44e61faa610e6c47d289d6e574399ce8330d68f9fa3ea3","observation_id":"42a462de-e2fb-48b3-aca0-955fa7c0511f","resolution":{"observed_at":"2026-08-11T05:58:55.103299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:55.108351Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.108351Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:dc14cf54df409ecf1b151ed033ab23847fe9ad3a3f543319607d9e290270aed7","observation_id":"ddb7a3b0-ff54-4735-b94a-39f3bdf62fe0","resolution":{"observed_at":"2026-08-11T05:58:55.108351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.08633","last_updated":"2022-05-08T05:17:15Z","snapshot_observed_at":"2026-08-10T12:57:12.198694Z","submitted_at":"2021-12-16T05:17:56Z","title":"Learning To Retrieve Prompts for In-Context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.08633","snapshot_observed_at":"2026-08-11T05:58:55.113484Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.113484Z"},"links":{"cited_paper":"/paper/2112.08633","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:bc0c43e4cf6742f0a55e5ca18c28c7bebfbcdc306eb1a0481ed8607cebf35e3d","observation_id":"17eb3779-3389-45d8-92f7-844cfab44168","resolution":{"observed_at":"2026-08-11T05:58:55.113484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:55.118455Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.118455Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:e9ef37f365bcc461b63efdf6137c385dd0e10546400d2247626acd02a96cb924","observation_id":"ee3da37a-2e1c-47aa-b98e-2e18e63c1948","resolution":{"observed_at":"2026-08-11T05:58:55.118455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:56.035143Z","title":null,"venue":null,"work_id":"e9a634eb-4e96-4d71-a6f2-73df4dff5e02","year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.123192Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:9f56bf4b8fd9e6e9d760fc86e6cd18b4c8091d58525675c9e4a2a3de6d061b3f","observation_id":"10a8ceaa-9650-4708-a9a2-df6fa1037d53","resolution":{"observed_at":"2026-08-11T05:58:56.039896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T05:58:55.127695Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.127695Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:ac5987394e7e9f1ca46bb1ced95610b2c7c2877befee1d2ef5f290fa04e0ffb9","observation_id":"0c6c9a4a-4e4c-4f4e-9a78-4545e61318e4","resolution":{"observed_at":"2026-08-11T05:58:55.127695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T05:58:55.132354Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.132354Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:7b01822bdda332ef33f253d2f793d104f59c758b286d259bb52a4d4e471cdf60","observation_id":"e998d90b-602c-4255-9e4f-022fb2a66a3e","resolution":{"observed_at":"2026-08-11T05:58:55.132354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:56.019063Z","title":null,"venue":null,"work_id":"52ee4775-029c-4ef4-a254-40d27ba870b8","year":2020},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.138258Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:80321771add599c9556d98075712ffde4272bc73c6f2b280e0eee0717b20b8f0","observation_id":"ad687379-b902-4a92-a087-235bc53f3dc7","resolution":{"observed_at":"2026-08-11T05:58:56.024132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03731","last_updated":"2023-10-05T17:52:09Z","snapshot_observed_at":"2026-08-13T05:55:59.432178Z","submitted_at":"2023-10-05T17:52:09Z","title":"MathCoder: Seamless Code Integration in LLMs for Enhanced Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03731","snapshot_observed_at":"2026-08-11T05:58:55.143093Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.143093Z"},"links":{"cited_paper":"/paper/2310.03731","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:d965b072ff0fa450959371ab49fd86152acd09f4a2506c44a86ef80b04d410b8","observation_id":"61b615f9-0986-4ff2-9124-1a365d7dc5a3","resolution":{"observed_at":"2026-08-11T05:58:55.143093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-08-14T10:08:59.886019Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-11T05:58:55.148293Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.148293Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:cf3526cd8154b66a224a6593ec96c1ccd0724fdba2c727b7fe837378dfe7d0a2","observation_id":"5eb52ec2-4b33-442f-920f-722fd7576663","resolution":{"observed_at":"2026-08-11T05:58:55.148293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:56.002896Z","title":null,"venue":null,"work_id":"3897f8be-b487-4aad-9439-69dc1cca6259","year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.153367Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:feee6b4e01c4a15f8115821ac6b7ff1806954141d9c2929cbba11ab0e325af00","observation_id":"6d79ee24-9145-4b79-b4df-ca405501395e","resolution":{"observed_at":"2026-08-11T05:58:56.007827Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-11T05:58:55.157913Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.157913Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:50f7dbad3beb941a7391fd2287203dbfd3e3e9c55e06c1b8539489fa63086f24","observation_id":"305c946a-d677-4a17-b026-95ae24084e2c","resolution":{"observed_at":"2026-08-11T05:58:55.157913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10200","last_updated":"2024-05-23T20:53:59Z","snapshot_observed_at":"2026-08-13T04:18:04.668988Z","submitted_at":"2024-02-15T18:55:41Z","title":"Chain-of-Thought Reasoning Without Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10200","snapshot_observed_at":"2026-08-11T05:58:55.162947Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.162947Z"},"links":{"cited_paper":"/paper/2402.10200","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:4b773eaae4d8b22599d11034f23b551f83cfac742d2b974cd367d5f1c45e2fb1","observation_id":"11757126-443c-49c2-b5ad-34ec9a99951d","resolution":{"observed_at":"2026-08-11T05:58:55.162947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:55.167844Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.167844Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:222f865689b4cac05d3f751fb323982d5f38979a0a876b9fd621eb29bccea171","observation_id":"c4467c97-9054-4550-9941-89a9fbf83c04","resolution":{"observed_at":"2026-08-11T05:58:55.167844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11829","last_updated":"2023-11-20T15:04:50Z","snapshot_observed_at":"2026-08-13T19:33:21.711191Z","submitted_at":"2023-11-20T15:04:50Z","title":"System 2 Attention (is something you might need too)","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11829","snapshot_observed_at":"2026-08-11T05:58:55.172679Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.172679Z"},"links":{"cited_paper":"/paper/2311.11829","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:0d90de7cd37360c37004c4f3a870d24f6896716c27b8c54fc9c9b304ec5ed8e7","observation_id":"8e85315d-42f3-4657-9940-03f8e81d628d","resolution":{"observed_at":"2026-08-11T05:58:55.172679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00451","last_updated":"2024-06-17T22:11:49Z","snapshot_observed_at":"2026-08-13T00:17:43.021579Z","submitted_at":"2024-05-01T11:10:24Z","title":"Monte Carlo Tree Search Boosts Reasoning via Iterative Preference Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00451","snapshot_observed_at":"2026-08-11T05:58:55.177931Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.177931Z"},"links":{"cited_paper":"/paper/2405.00451","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:a255a51592189241a7c34cf23973ef6093251fa51567a6bcb82aa81a0d87531b","observation_id":"f562407d-f349-4e75-ab5c-e7e219e36a82","resolution":{"observed_at":"2026-08-11T05:58:55.177931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-13T02:06:18.586697Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-11T05:58:55.183003Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.183003Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:1dd48cc83fb7b40e253792e6d96d18fea4f59b5ee72984c5b151db513ba28e87","observation_id":"21267594-fc1c-4c62-a541-0172c08a73b8","resolution":{"observed_at":"2026-08-11T05:58:55.183003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02893","last_updated":"2024-04-03T17:51:18Z","snapshot_observed_at":"2026-08-13T00:38:17.242638Z","submitted_at":"2024-04-03T17:51:18Z","title":"ChatGLM-Math: Improving Math Problem-Solving in Large Language Models with a Self-Critique Pipeline","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02893","snapshot_observed_at":"2026-08-11T05:58:55.188091Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.188091Z"},"links":{"cited_paper":"/paper/2404.02893","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:324e3a063079aac8dc864b9590558f52c6bff661819a6d2440a550d550bd8c2f","observation_id":"2a5a9bdd-4dc0-44db-a490-7088e8972f23","resolution":{"observed_at":"2026-08-11T05:58:55.188091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:55.974317Z","title":null,"venue":null,"work_id":"1486a05e-c533-4833-a917-24012b8b0370","year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.193173Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:44ee8b191572d7b677392b4b94472a235b2d0e75471be4083428cb841414e734","observation_id":"610c0677-6bf0-44bd-9830-468fef4cd1af","resolution":{"observed_at":"2026-08-11T05:58:55.980710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:55.198062Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.198062Z"},"links":{"citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:dbd1a9ea83653d0d7cc1f1d935b834b056e7c9feb072dab3ce822f026fb6e8cc","observation_id":"e04895ca-c65d-4e04-af00-f2e315aeef83","resolution":{"observed_at":"2026-08-11T05:58:55.198062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-11T05:58:55.202680Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.202680Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:741250c974ec4dcb6eef0d379338b0a66dbb911c982f080c2bda9caa281563f5","observation_id":"b222c06f-31ca-4120-92a0-cba318ac3544","resolution":{"observed_at":"2026-08-11T05:58:55.202680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-13T10:57:13.012119Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-11T05:58:55.207817Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.207817Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:acd2d6ba11eeb94378903635628640e1bfb23b5fbfd66c5c9509d09981351187","observation_id":"341217fb-23f0-473b-8fd8-8d4645a44013","resolution":{"observed_at":"2026-08-11T05:58:55.207817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06023","last_updated":"2024-07-24T18:40:36Z","snapshot_observed_at":"2026-08-12T23:26:39.760805Z","submitted_at":"2024-07-08T15:17:46Z","title":"Distilling System 2 into System 1","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06023","snapshot_observed_at":"2026-08-11T05:58:55.212867Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.212867Z"},"links":{"cited_paper":"/paper/2407.06023","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:668706a78c289f8a2d4003a26c5210d082cd1b9b6fa1df79e26520a1fdfc162c","observation_id":"9a82b1b6-4630-445e-879d-9b5a8dfa9cfb","resolution":{"observed_at":"2026-08-11T05:58:55.212867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01825","last_updated":"2023-09-13T03:57:29Z","snapshot_observed_at":"2026-08-13T12:20:57.788212Z","submitted_at":"2023-08-03T15:34:01Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01825","snapshot_observed_at":"2026-08-11T05:58:55.218048Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.218048Z"},"links":{"cited_paper":"/paper/2308.01825","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:1ff410e98d2364ebc5da41d12bc8a7e9794bd5f16c2985ce2ece8b83f5ef5ebf","observation_id":"4ec33a4c-6752-42a3-b9e8-c8c3178105c1","resolution":{"observed_at":"2026-08-11T05:58:55.218048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05653","last_updated":"2023-10-03T02:48:42Z","snapshot_observed_at":"2026-08-07T14:43:09.380195Z","submitted_at":"2023-09-11T17:47:22Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05653","snapshot_observed_at":"2026-08-11T05:58:55.222846Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.222846Z"},"links":{"cited_paper":"/paper/2309.05653","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:764d2a872714a7602828f6dc29c510f6a632edee2080a99ce2214b62e290d604","observation_id":"4c3ab58e-a1b7-4650-a0a5-d5ab3d6e03e9","resolution":{"observed_at":"2026-08-11T05:58:55.222846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-11T05:58:55.227674Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.227674Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:b42858a2974cce635c41ec83367cd124f725c06cbab086004d9304decb196a75","observation_id":"3169f3cd-eba6-4fc4-abd7-d459329a2815","resolution":{"observed_at":"2026-08-11T05:58:55.227674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07484","last_updated":"2024-10-11T23:32:09Z","snapshot_observed_at":"2026-08-12T22:26:47.440166Z","submitted_at":"2024-10-09T23:37:36Z","title":"WALL-E: World Alignment by Rule Learning Improves World Model-based LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07484","snapshot_observed_at":"2026-08-11T05:58:55.232552Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T05:58:55.232552Z"},"links":{"cited_paper":"/paper/2410.07484","citing_paper":"/paper/2412.16964"},"observation_digest":"sha256:189e8feda40ac4757c0d364c9267e0137b4c52727cb6b2891499a396e2783a15","observation_id":"c6ff499b-e65d-4f26-8121-c0c08d514e09","resolution":{"observed_at":"2026-08-11T05:58:55.232552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.16964","last_updated":"2024-12-24T11:43:25Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-11T05:53:54.668426Z","submitted_at":"2024-12-22T10:49:27Z","title":"System-2 Mathematical Reasoning via Enriched Instruction Tuning"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":60,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 2 inbound Pith citation observations for arXiv:2412.16964."}