{"as_of":"2026-08-09T17:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b1eb2dbf0c7a6cc4e7688ee1df9c563df6d354feb5e2e54da7c5b27433b77fcd","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:56:12.693765Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T08:40:40.910461Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T08:40:41.519148Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"cited_work":{"arxiv_id":"2507.04348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04348","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smartthinker: Learning to compress and preserve reasoning by step-level length control","venue":null,"work_id":"c0792300-9314-4a29-ae11-db326a037049","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":254,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2507.04348","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:15712a939dea83a032092be04aa9e7aaf019f34bdb4777b076d521844de00268","observation_id":"d2f968aa-8abf-4763-a7f7-005cf66bfd4a","resolution":{"observed_at":"2026-05-12T08:40:41.521904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"cited_work":{"arxiv_id":"2507.04348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04348","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smartthinker: Learning to compress and preserve reasoning by step-level length control","venue":null,"work_id":"c0792300-9314-4a29-ae11-db326a037049","year":2025},"citing_paper":{"arxiv_id":"2605.09806","last_updated":"2026-05-10T23:05:02Z","snapshot_observed_at":"2026-07-06T23:21:49.499951Z","submitted_at":"2026-05-10T23:05:02Z","title":"LEAD: Length-Efficient Adaptive and Dynamic Reasoning for Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T02:30:42.407934Z"},"links":{"cited_paper":"/paper/2507.04348","citing_paper":"/paper/2605.09806"},"observation_digest":"sha256:caf78c3d891826fdd7b4a51a4edbe058f1bfc6c03c80d6addd085af7252eac9c","observation_id":"37bf9325-8400-4a28-8c05-6eeb25e102bb","resolution":{"observed_at":"2026-05-12T02:31:16.824046Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.04348/citation-record","integrity":"/paper/2507.04348/integrity","json":"/paper/2507.04348/citation-record.json","paper":"/paper/2507.04348"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:07.478095Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:07.478095Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:4b31adb9992e503b4ce4465a19692eb02339294bec35c99d95eee2d30c0d7196","observation_id":"87c4d026-d001-4594-9a12-152d9bd6882a","resolution":{"observed_at":"2026-08-06T19:56:07.478095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:07.510678Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:07.510678Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:fb6b1904e16990a286c1c990dfc243fd345b2ab8ad511a5f88947991a9ee39ce","observation_id":"17cfd17f-256f-49e5-825d-079ec7b32db6","resolution":{"observed_at":"2026-08-06T19:56:07.510678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-06T08:53:09.095000Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-06T19:56:07.574963Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:07.574963Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:811ed40f4e23b76d4386f0a9addc907dc299618ff850e69fe05acdfc876c5a3b","observation_id":"5a9320c9-b1b2-4ba7-8314-9d125f75acf1","resolution":{"observed_at":"2026-08-06T19:56:07.574963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:07.687766Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:07.687766Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:822f42ddc441df08ddb5dec8f937200d7a71c61f9a0edbe7b9c6c922c3c49646","observation_id":"ba270698-182f-4c97-9647-28078580cd1b","resolution":{"observed_at":"2026-08-06T19:56:07.687766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19470","last_updated":"2025-09-23T03:45:42Z","snapshot_observed_at":"2026-08-09T02:50:54.082128Z","submitted_at":"2025-03-25T09:00:58Z","title":"ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19470","snapshot_observed_at":"2026-08-06T19:56:07.843931Z","title":"Z.; Zhang, W.; Chen, H.; Yang, F.; et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:07.843931Z"},"links":{"cited_paper":"/paper/2503.19470","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:3c9d3a8d91286ae8274ea8a44a7fa80081689511a1a7ac9a72bd248fd80a1d1b","observation_id":"8962900f-e440-4b1d-acb8-36b18ed92c29","resolution":{"observed_at":"2026-08-06T19:56:07.843931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-06T19:56:08.050411Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:08.050411Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:71451dda8c0cf9722c7f15c743532d3505139206e338a47787da8535f38fb653","observation_id":"68c843f2-3526-4953-90f4-c1d7b75e6176","resolution":{"observed_at":"2026-08-06T19:56:08.050411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-06T19:56:08.287459Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:08.287459Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:9b7a0755e27378d1b7dcdb9adef187411e35c9102ed2d945d9cf439c3911c58d","observation_id":"5b041dec-6184-4ac8-8035-3c935f3d0ce6","resolution":{"observed_at":"2026-08-06T19:56:08.287459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08235","last_updated":"2025-02-12T09:23:26Z","snapshot_observed_at":"2026-08-08T15:07:58.178948Z","submitted_at":"2025-02-12T09:23:26Z","title":"The Danger of Overthinking: Examining the Reasoning-Action Dilemma in Agentic Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08235","snapshot_observed_at":"2026-08-06T19:56:08.440220Z","title":"G.; Xia, T.; Mao, H.; et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:08.440220Z"},"links":{"cited_paper":"/paper/2502.08235","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:c6667cd12e3e825c8fc1a8fd7076a24672c32d8dcfbfebb4daea6e7486075aab","observation_id":"7bb425ca-7757-4334-8401-3f1cc9aa14f7","resolution":{"observed_at":"2026-08-06T19:56:08.440220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13379","last_updated":"2025-06-26T14:06:49Z","snapshot_observed_at":"2026-08-08T22:27:57.440955Z","submitted_at":"2025-05-19T17:24:16Z","title":"Thinkless: LLM Learns When to Think","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13379","snapshot_observed_at":"2026-08-06T19:56:08.680429Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:08.680429Z"},"links":{"cited_paper":"/paper/2505.13379","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:61f5442a2dc967a7df90a5b13e0a5192c7b2885f1c5628f5681772f89ee7be8c","observation_id":"6d898a92-237a-487e-9dd3-77011c2e65ed","resolution":{"observed_at":"2026-08-06T19:56:08.680429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:08.760553Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:08.760553Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:bd334217f15238eb06f08c4cb6ea6fe9387f8809a55794e2b14c063eff6c5009","observation_id":"77f159cb-46bd-42e1-9df3-81ab49be877e","resolution":{"observed_at":"2026-08-06T19:56:08.760553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20993","last_updated":"2025-05-27T16:41:53Z","snapshot_observed_at":"2026-07-06T20:14:40.579474Z","submitted_at":"2024-12-30T14:57:53Z","title":"Efficiently Scaling LLM Reasoning with Certaindex","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20993","snapshot_observed_at":"2026-08-06T19:56:08.863416Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:08.863416Z"},"links":{"cited_paper":"/paper/2412.20993","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:a94001e33deda457c632dc090a9ae373c760cd394f40d420153467c5eab01cce","observation_id":"957e12f6-f41d-494b-b36b-0271a1856491","resolution":{"observed_at":"2026-08-06T19:56:08.863416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T19:56:09.011407Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:09.011407Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:8845ff25f6c05711f1be4ec3bd9bd3b92a81c9c91d60394dbe38b1ff66832bfb","observation_id":"c16388d5-345d-4fd9-bdb4-654fbeabd5ab","resolution":{"observed_at":"2026-08-06T19:56:09.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18547","last_updated":"2025-06-02T00:44:09Z","snapshot_observed_at":"2026-08-07T19:18:10.858896Z","submitted_at":"2024-12-24T16:55:45Z","title":"Token-Budget-Aware LLM Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18547","snapshot_observed_at":"2026-08-06T19:56:09.165310Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:09.165310Z"},"links":{"cited_paper":"/paper/2412.18547","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:d42cd76562757912a99cde71d0a2f4b86d114be499eddaed30e3a94a9d936a58","observation_id":"585537f7-73a5-4327-b89f-827ce3574e73","resolution":{"observed_at":"2026-08-06T19:56:09.165310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14008","last_updated":"2024-06-06T13:19:44Z","snapshot_observed_at":"2026-08-03T03:39:09.398343Z","submitted_at":"2024-02-21T18:49:26Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14008","snapshot_observed_at":"2026-08-06T19:56:09.322919Z","title":"L.; Shen, J.; Hu, J.; Han, X.; Huang, Y.; Zhang, Y.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:09.322919Z"},"links":{"cited_paper":"/paper/2402.14008","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:e1bad64cb1f5a9e43a4dabe49ef1f354ee805bd9f916a4cfb53afc630a5dfc57","observation_id":"50d8b192-8840-4661-bb41-be20bb559d74","resolution":{"observed_at":"2026-08-06T19:56:09.322919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-06T19:56:09.437194Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:09.437194Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:a72947f592622bf39e3ef5852d9f2745ae15814b983ad907b1b66b713710fa5c","observation_id":"be5ae241-a737-441d-823b-1c39f088cc8c","resolution":{"observed_at":"2026-08-06T19:56:09.437194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01296","last_updated":"2025-04-02T01:59:26Z","snapshot_observed_at":"2026-07-30T08:40:23.849282Z","submitted_at":"2025-04-02T01:59:26Z","title":"ThinkPrune: Pruning Long Chain-of-Thought of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01296","snapshot_observed_at":"2026-08-06T19:56:09.525446Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:09.525446Z"},"links":{"cited_paper":"/paper/2504.01296","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:f0a4880ef5686f18ee286288101a5d162d42733175d2ab47249fbce657284272","observation_id":"e888a6d6-7f90-4269-ae9b-a588a6ab494f","resolution":{"observed_at":"2026-08-06T19:56:09.525446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:09.655142Z","title":"J.; Shen, Y.; Wallis, P.; Allen-Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; Chen, W.; et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:09.655142Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:e52c2bc252d23fc0a2e1988efab48c8d56b453e1e21079e8b47e8062e057d574","observation_id":"dc2ce4a3-d2eb-4e5b-bdf4-b1e2c8f058d3","resolution":{"observed_at":"2026-08-06T19:56:09.655142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-06T19:56:09.810675Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:09.810675Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:4e419f8ccdc71c75a6509bbac0de785b842de676cf5fbeda14de04a260a472e9","observation_id":"e1ad6237-7150-4f3f-8a83-291c0029ce82","resolution":{"observed_at":"2026-08-06T19:56:09.810675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-06T19:56:09.972378Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:09.972378Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:ffc4e8b3d28e8a27e48c4426aad3da1f6a19700f5f51030713aa8d24e5abb521","observation_id":"3f601a50-bbf5-4966-b712-918ac98c0442","resolution":{"observed_at":"2026-08-06T19:56:09.972378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:13.651932Z","title":null,"venue":null,"work_id":"4fcc1003-296b-4172-af6a-fa28a69f00df","year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:10.149719Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:3bbe638910c5ef0dac071ae03df9ed56659dd89a6d87590c02038dc0b6d2118d","observation_id":"c483a754-4f3b-4c62-8cfe-9f9bcfdfdfb4","resolution":{"observed_at":"2026-08-06T19:56:13.654391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04683","last_updated":"2017-12-05T19:36:03Z","snapshot_observed_at":"2026-08-07T10:40:47.462532Z","submitted_at":"2017-04-15T19:31:41Z","title":"RACE: Large-scale ReAding Comprehension Dataset From Examinations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04683","snapshot_observed_at":"2026-08-06T19:56:10.289215Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:10.289215Z"},"links":{"cited_paper":"/paper/1704.04683","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:ad72e40eee14c54dcdfbf33ab30e2569292299e525c6a6bf4ad22a872af066db","observation_id":"25cee0b4-c1d2-43d4-a887-187f91f61ddc","resolution":{"observed_at":"2026-08-06T19:56:10.289215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:13.645557Z","title":null,"venue":null,"work_id":"8308fe7f-5363-45fc-9dae-3fe8689fcab2","year":2022},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:10.362683Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:2378b21f22eaab55600a1032aa7d36060f094ef1e378219db7dc13298662cbd2","observation_id":"c192bcdf-1286-443a-8d2c-40228131030a","resolution":{"observed_at":"2026-08-06T19:56:13.647554Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-06T19:56:10.448326Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:10.448326Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:83bcf27acec2a7eb65756419361350417f032c499703323751794c08039c2808","observation_id":"805c8b2d-1fc1-4513-8ebf-9c6fa38f3e21","resolution":{"observed_at":"2026-08-06T19:56:10.448326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-06T19:56:10.535917Z","title":"S.; and Lin, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:10.535917Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:fb10cea4ef6b5f9d313adefeaa4f28915447dd294261b12d46b4d8d788954660","observation_id":"3d73eea1-4f5d-419a-99a8-0a1d1075a661","resolution":{"observed_at":"2026-08-06T19:56:10.535917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T19:56:10.649664Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:10.649664Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:d411f36f2da720b7b912416fb821cffb98570ee888eabfc375b9758c28271ae4","observation_id":"a79c059b-a4cc-4707-a87c-17c37dc87bae","resolution":{"observed_at":"2026-08-06T19:56:10.649664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11896","last_updated":"2025-05-25T13:39:29Z","snapshot_observed_at":"2026-08-07T15:44:24.427443Z","submitted_at":"2025-05-17T08:27:00Z","title":"AdaCoT: Pareto-Optimal Adaptive Chain-of-Thought Triggering via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11896","snapshot_observed_at":"2026-08-06T19:56:10.766374Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:10.766374Z"},"links":{"cited_paper":"/paper/2505.11896","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:11be1b6b4fe492e65aa5a3cabea4b3c87ac69ea92f95fdc5562eaa500f0fa05e","observation_id":"c729fc40-e11e-43ca-8a04-89ac9c5ada66","resolution":{"observed_at":"2026-08-06T19:56:10.766374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21659","last_updated":"2025-05-21T11:59:38Z","snapshot_observed_at":"2026-08-07T15:57:54.877503Z","submitted_at":"2025-04-30T14:01:45Z","title":"Ada-R1: Hybrid-CoT via Bi-Level Adaptive Reasoning Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21659","snapshot_observed_at":"2026-08-06T19:56:10.895596Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:10.895596Z"},"links":{"cited_paper":"/paper/2504.21659","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:3aa6448bdf30259a2293fc4c7e4e83597381e64f7158cf559ed1a786a6bbaf53","observation_id":"00c8ce7c-3dd3-42e8-b0ed-539d688e4a89","resolution":{"observed_at":"2026-08-06T19:56:10.895596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06592","snapshot_observed_at":"2026-08-06T19:56:10.901840Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:10.901840Z"},"links":{"cited_paper":"/paper/2406.06592","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:e02c1259f5d62b4e0d660070623faeef6ccff37afb35db0533332920d511b060","observation_id":"dacf0e43-456d-4498-be74-26346cade428","resolution":{"observed_at":"2026-08-06T19:56:10.901840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:10.910223Z","title":"Y.; Roongta, M.; Cai, C.; Luo, J.; Zhang, T.; Li, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:10.910223Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:f791f362069a24c32a2b52b3228bfff0abe868edcd3519b1184cb5888d8ed6d7","observation_id":"69ce7d35-5c89-4a97-931c-39020b5c5ed6","resolution":{"observed_at":"2026-08-06T19:56:10.910223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:11.021958Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:11.021958Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:75089020242fbc3e40c1d47755332a1476660033ffc8ac440f9f74ef77d84ea7","observation_id":"46c90150-b427-48a3-9694-3b22a8b26fe8","resolution":{"observed_at":"2026-08-06T19:56:11.021958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:11.144411Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:11.144411Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:e5cebd529cf2e2240e24ec2f2250f11244fe97a5a534c75e810a039a13a84daf","observation_id":"09bbf56f-cd31-4e62-90d6-1cf26dbaa500","resolution":{"observed_at":"2026-08-06T19:56:11.144411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T19:56:11.260842Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:11.260842Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:df6d15b07d68590130ec5cb0f47ec5aa257b366d26d1252f4511216b632a8be2","observation_id":"e14c2f65-26f4-4c82-a7b8-537b3e4dca32","resolution":{"observed_at":"2026-08-06T19:56:11.260842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-06T19:56:11.387447Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:11.387447Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:9f1c1f68bd88c4dc55867206484b1094a8df13606d71233b62399b2d97c90062","observation_id":"70af886a-f2c4-4f47-8861-3c05ad305184","resolution":{"observed_at":"2026-08-06T19:56:11.387447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:13.628696Z","title":null,"venue":null,"work_id":"bb78b412-505a-4d07-b06b-9dab0eac9241","year":2023},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:11.498597Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:fdd6a1264741d0bd37b58bcdd6029efee4944b9e96f3eee4b0ee8382839fad18","observation_id":"7cddc7c7-6a3e-42f6-8473-ad49d7e386af","resolution":{"observed_at":"2026-08-06T19:56:13.632257Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04644","last_updated":"2025-07-14T20:06:23Z","snapshot_observed_at":"2026-08-08T21:56:36.049143Z","submitted_at":"2025-02-07T04:08:46Z","title":"Agentic Reasoning: A Streamlined Framework for Enhancing LLM Reasoning with Agentic Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04644","snapshot_observed_at":"2026-08-06T19:56:11.606052Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:11.606052Z"},"links":{"cited_paper":"/paper/2502.04644","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:a206a9070a6f173c3a6a7e325a080238cd3dd9fe8b21cc146ad4f3d573fefc37","observation_id":"0b9b5249-c3bb-4d48-85f6-af76a6bc3c5b","resolution":{"observed_at":"2026-08-06T19:56:11.606052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:11.746816Z","title":"T.; Wang, W.; and Li, W","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:11.746816Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:8a62ca0cd7d08bde6fbac02aec1ad571a55c8eda5a83d6b570f530accd61e987","observation_id":"f59bcfe8-425b-472b-85b4-598f2472217c","resolution":{"observed_at":"2026-08-06T19:56:11.746816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-07T17:49:06.764625Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-06T19:56:11.857325Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:11.857325Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:a6ff01c94687fe3bc8306e1ad2ddaceb7001e3dcb9d973b71c4c6e6a90fc7e5f","observation_id":"fedba185-06ba-4684-8cad-ba78f6dfc5ce","resolution":{"observed_at":"2026-08-06T19:56:11.857325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:11.961882Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:11.961882Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:5562436fddb8e9d988d424cd4a7f585043bb643fb6116ff631d1b0672fb03d75","observation_id":"87045524-8bb2-49f1-85a4-61f17bc3a6dd","resolution":{"observed_at":"2026-08-06T19:56:11.961882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-06T19:56:12.062937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:12.062937Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:fbdadd77c8954be2f43c265cd18c46888653644430e69cad42909ef9ba84e4c3","observation_id":"ad0bc26a-f805-44a1-91ec-df47d777ea30","resolution":{"observed_at":"2026-08-06T19:56:12.062937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-06T19:56:12.170017Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:12.170017Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:41e03307a3e69e376e52f9215cdd3fef7c3d68f2c57730db0027ae0144679fbc","observation_id":"039ddf1c-aa30-4033-81ba-d40b5cc4215b","resolution":{"observed_at":"2026-08-06T19:56:12.170017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T19:56:12.302581Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:12.302581Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:4ee9ea20782ff31256a456cc381308b145b2948581b76264398a110268ddf0ad","observation_id":"33a4b96d-a482-4276-beae-6d0827f84a70","resolution":{"observed_at":"2026-08-06T19:56:12.302581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13417","last_updated":"2025-05-19T17:50:52Z","snapshot_observed_at":"2026-08-07T15:42:59.701048Z","submitted_at":"2025-05-19T17:50:52Z","title":"AdaptThink: Reasoning Models Can Learn When to Think","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13417","snapshot_observed_at":"2026-08-06T19:56:12.451362Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:12.451362Z"},"links":{"cited_paper":"/paper/2505.13417","citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:62efe2a287778f86446dc3fbdbf72edaf097cf0844c79f944d2aa921cf442f07","observation_id":"8c3b4480-5a32-4ed7-b9ec-caec46455731","resolution":{"observed_at":"2026-08-06T19:56:12.451362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:12.603733Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:12.603733Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:77acef76a561101180f32519348e296cf0151b01f29d629372747188e8f0f13f","observation_id":"a00afbad-86ec-453f-8309-4dc10bd4834f","resolution":{"observed_at":"2026-08-06T19:56:12.603733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:12.614141Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:12.614141Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:90d11ceaed72e0fc763275e2ec542cd271664710761089a2a41d6fc632b93316","observation_id":"d667b62d-7578-4aef-b5c6-9f713aae04d4","resolution":{"observed_at":"2026-08-06T19:56:12.614141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:56:12.693765Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T19:56:12.693765Z"},"links":{"citing_paper":"/paper/2507.04348"},"observation_digest":"sha256:e2a1cd7f79d73da2fd83c2bc9051263d10389fb4e74ee70ba1b67a0dc983fe7f","observation_id":"75aab90b-63ca-490d-aafd-8663cadd0091","resolution":{"observed_at":"2026-08-06T19:56:12.693765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.04348","last_updated":"2025-07-17T13:07:41Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T11:19:31.796880Z","submitted_at":"2025-07-06T11:21:47Z","title":"SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 2 inbound Pith citation observations for arXiv:2507.04348."}