{"as_of":"2026-08-10T22:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5fd5b50e94b9ed0d225a934d1daf6da9b30a4c8689e5bc9d05d239c5618ebf5f","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:00:46.016123Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T22:25:54.860141Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:09:40.738273Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20160","snapshot_observed_at":"2026-08-04T22:25:54.860141Z","title":"Aalc: Large language model efficient reasoning via adaptive accuracy-length control.ArXiv, abs/2506.20160, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07339","last_updated":"2025-09-09T02:31:16Z","snapshot_observed_at":"2026-08-08T07:12:41.500683Z","submitted_at":"2025-09-09T02:31:16Z","title":"Performative Thinking? The Brittle Correlation Between CoT Length and Problem Complexity","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T22:25:54.860141Z"},"links":{"cited_paper":"/paper/2506.20160","citing_paper":"/paper/2509.07339"},"observation_digest":"sha256:1b4b1b84774661faf1c331f12d7cc82399a480896edc73262ec2d056ba9b5615","observation_id":"6de193bf-8222-4a06-9f53-3ac1ecdb7cc1","resolution":{"observed_at":"2026-08-04T22:25:54.860141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"cited_work":{"arxiv_id":"2506.20160","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.20160","snapshot_observed_at":"2026-07-04T08:09:40.738273Z","title":"Aalc: Large language model efficient reasoning via adaptive accuracy-length control","venue":null,"work_id":"899bfd26-fd51-4013-a4ba-dde51db36f97","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2506.20160","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:ad39b7433b4ef4c20b4449526566cc1d78c33a63724158ff5da8d29dd9ba6bf6","observation_id":"5d88afe3-db78-4c7c-8106-7475dddf4cd3","resolution":{"observed_at":"2026-05-22T05:51:08.318894Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"cited_work":{"arxiv_id":"2506.20160","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.20160","snapshot_observed_at":"2026-07-04T08:09:40.738273Z","title":"Aalc: Large language model efficient reasoning via adaptive accuracy-length control","venue":null,"work_id":"899bfd26-fd51-4013-a4ba-dde51db36f97","year":2025},"citing_paper":{"arxiv_id":"2606.21943","last_updated":"2026-06-20T08:20:41Z","snapshot_observed_at":"2026-07-06T23:56:54.959593Z","submitted_at":"2026-06-20T08:20:41Z","title":"Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-06-26T12:15:08.304150Z"},"links":{"cited_paper":"/paper/2506.20160","citing_paper":"/paper/2606.21943"},"observation_digest":"sha256:2e78d1e963692957fc719098bb6f673abf5a7bc2c7dde61543206212e53b1077","observation_id":"f950d19c-89b2-4864-acdf-d5e68e676675","resolution":{"observed_at":"2026-07-04T08:09:40.739876Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.20160/citation-record","integrity":"/paper/2506.20160/integrity","json":"/paper/2506.20160/citation-record.json","paper":"/paper/2506.20160"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-06T08:53:09.095000Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-06T23:00:45.896824Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.896824Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:a0a1bf394a2028ef2f5dc54107214d906384d18be046347e31246f4e32e7e04e","observation_id":"028d8f70-57d9-4559-8059-0b3590c47a08","resolution":{"observed_at":"2026-08-06T23:00:45.896824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:45.900579Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.900579Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:46a09831027165b887e952c0adda1894633e20bf579ad8a49cb6c64a17541a12","observation_id":"2c51a3ec-deff-414c-8709-9a28cb4b9e15","resolution":{"observed_at":"2026-08-06T23:00:45.900579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-06T23:00:45.903761Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.903761Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:ff56276029f57228470deb4ea1d44b6c25969043cd50bc533c3851b4401c908b","observation_id":"ae850b0c-3698-4c75-9a6d-d80d830f0df4","resolution":{"observed_at":"2026-08-06T23:00:45.903761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T23:00:45.908171Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.908171Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:97820d8ad0ae7dc078813236044740f9a6c47897913d4b5f17b5661ba26aac89","observation_id":"fa7b49d4-7307-44d6-beb0-a94e6a2634d7","resolution":{"observed_at":"2026-08-06T23:00:45.908171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16235","last_updated":"2025-02-27T06:39:06Z","snapshot_observed_at":"2026-08-07T17:56:27.359357Z","submitted_at":"2025-02-22T14:13:37Z","title":"Dynamic Parallel Tree Search for Efficient LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16235","snapshot_observed_at":"2026-08-06T23:00:45.915401Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.915401Z"},"links":{"cited_paper":"/paper/2502.16235","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:58837823c329fbd7fc352426246551df7fc7e2dcd923d888934271b9d9c12411","observation_id":"ad293dbc-b6e4-4eeb-b56f-d774d25b3502","resolution":{"observed_at":"2026-08-06T23:00:45.915401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01307","last_updated":"2025-08-15T15:21:46Z","snapshot_observed_at":"2026-08-08T21:52:29.510852Z","submitted_at":"2025-03-03T08:46:22Z","title":"Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01307","snapshot_observed_at":"2026-08-06T23:00:45.919023Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.919023Z"},"links":{"cited_paper":"/paper/2503.01307","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:dfac22c238068fe82d088fa68b3ad02037e27135d38037e6f8ebb0a762749346","observation_id":"82a1a69e-fe1b-4351-b3a5-b337fe4eedd5","resolution":{"observed_at":"2026-08-06T23:00:45.919023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03683","last_updated":"2024-04-01T06:50:52Z","snapshot_observed_at":"2026-08-10T01:12:38.149323Z","submitted_at":"2024-04-01T06:50:52Z","title":"Stream of Search (SoS): Learning to Search in Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03683","snapshot_observed_at":"2026-08-06T23:00:45.922750Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.922750Z"},"links":{"cited_paper":"/paper/2404.03683","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:1d54a9b9236f13e35aaff6a27bd3f0c9fbcabb6101d46a10a08c0c57eb8bccae","observation_id":"53017cde-e94e-400d-b014-c230cbbd76ed","resolution":{"observed_at":"2026-08-06T23:00:45.922750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:00:45.926589Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.926589Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:7bf71b33c512f1cda626f7d24a596bbdf5a62c313d968da5b9eeb23e1c5c94a4","observation_id":"448dc033-1c61-429f-ba42-057fddb0a7a2","resolution":{"observed_at":"2026-08-06T23:00:45.926589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18547","last_updated":"2025-06-02T00:44:09Z","snapshot_observed_at":"2026-08-07T19:18:10.858896Z","submitted_at":"2024-12-24T16:55:45Z","title":"Token-Budget-Aware LLM Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18547","snapshot_observed_at":"2026-08-06T23:00:45.930316Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.930316Z"},"links":{"cited_paper":"/paper/2412.18547","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:ca350032090850bfb8c5abbdba110b3142d946ea7a7bb2011a262ef449faa344","observation_id":"60c79c20-6b7c-400e-b27d-7e8872c995d6","resolution":{"observed_at":"2026-08-06T23:00:45.930316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-07T06:05:27.895209Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-06T23:00:45.933807Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.933807Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:ab4c8426a8e97457de6e305dfd2d7281318df0f0e74e525e8f1d46ec72876a7a","observation_id":"e4b8a9b6-6ee3-44a8-bc64-b4d5b7b7564a","resolution":{"observed_at":"2026-08-06T23:00:45.933807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-06T23:00:45.937187Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.937187Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:f9438ef551b66ed01f519ffd35b974f00e22e2715e6928ab760d6cc270989bec","observation_id":"216f8985-8b3c-4d77-b1e9-733e96516dae","resolution":{"observed_at":"2026-08-06T23:00:45.937187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00031","last_updated":"2025-02-25T00:21:14Z","snapshot_observed_at":"2026-08-10T01:27:28.903517Z","submitted_at":"2025-02-25T00:21:14Z","title":"Efficient Test-Time Scaling via Self-Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00031","snapshot_observed_at":"2026-08-06T23:00:45.940404Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.940404Z"},"links":{"cited_paper":"/paper/2503.00031","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:91b1ebd6fedded66582b1e79bdb647cb8e211e2efe74f9351daca8a43e5d4d20","observation_id":"f612e9d5-3c2c-4b20-9423-4174e9aa716c","resolution":{"observed_at":"2026-08-06T23:00:45.940404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T23:00:45.943511Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.943511Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:14a3be1ceb3851a020cb83a3a251f7d0523ddf618a484612bc5435eb888502e2","observation_id":"c1015e36-2a21-44ef-a067-8532f97fd935","resolution":{"observed_at":"2026-08-06T23:00:45.943511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19324","last_updated":"2025-06-26T03:14:46Z","snapshot_observed_at":"2026-08-10T13:46:16.822794Z","submitted_at":"2025-01-31T17:19:57Z","title":"Reward-Guided Speculative Decoding for Efficient LLM Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19324","snapshot_observed_at":"2026-08-06T23:00:45.946584Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.946584Z"},"links":{"cited_paper":"/paper/2501.19324","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:9527e4cf104a391d1b866939cdf06309298e787bbae9e29d3eabd2f0ad6d7715","observation_id":"87c8092e-3e82-4317-b042-40fe4076d637","resolution":{"observed_at":"2026-08-06T23:00:45.946584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12570","last_updated":"2025-01-29T03:11:03Z","snapshot_observed_at":"2026-08-10T17:00:34.555363Z","submitted_at":"2025-01-22T01:35:11Z","title":"O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12570","snapshot_observed_at":"2026-08-06T23:00:45.950071Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.950071Z"},"links":{"cited_paper":"/paper/2501.12570","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:7abe2a4d11dccf59485a07e1bf1b3bc3b2e1b21483e6b2116c9119ecda99b641","observation_id":"cf4e3ade-d53a-43b3-a0f6-3dac76332cdb","resolution":{"observed_at":"2026-08-06T23:00:45.950071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09601","last_updated":"2025-02-13T18:52:36Z","snapshot_observed_at":"2026-08-08T03:37:50.177168Z","submitted_at":"2025-02-13T18:52:36Z","title":"CoT-Valve: Length-Compressible Chain-of-Thought Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09601","snapshot_observed_at":"2026-08-06T23:00:45.953639Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.953639Z"},"links":{"cited_paper":"/paper/2502.09601","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:77c1df09256959cecb41f10886a201767bab615f52a37c4a4290794498970732","observation_id":"d804eaa1-86e2-4ab3-9e99-aa1d0a19528b","resolution":{"observed_at":"2026-08-06T23:00:45.953639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19825","last_updated":"2025-01-23T08:45:52Z","snapshot_observed_at":"2026-08-06T05:46:44.376142Z","submitted_at":"2024-07-29T09:21:52Z","title":"Concise Thoughts: Impact of Output Length on LLM Reasoning and Cost","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19825","snapshot_observed_at":"2026-08-06T23:00:45.956715Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.956715Z"},"links":{"cited_paper":"/paper/2407.19825","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:f05e25b953d610330cdf4337e610a2ac3f6f2152d3c7b160ff2fe87527a269b9","observation_id":"6cb5d714-993a-4e72-a0b2-1fb85c0d94ad","resolution":{"observed_at":"2026-08-06T23:00:45.956715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:46.509244Z","title":null,"venue":null,"work_id":"9cb00add-e880-4b56-a816-7476e6079be9","year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.960079Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:6f48df2c2488a2d32f7406ea705dffa854124cc5d3ad94f1b39643471baa04b9","observation_id":"0c579da2-e237-4b86-98a2-33bd6d1ef0cb","resolution":{"observed_at":"2026-08-06T23:00:46.512187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:45.963094Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.963094Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:e21d015d396b35963fa29119fe11129417400411c19bbfde52d129d86cba9f13","observation_id":"efcdbe51-b50e-4af5-bbf4-25258f9e38af","resolution":{"observed_at":"2026-08-06T23:00:45.963094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:45.965958Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.965958Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:cd0c39d3eddad46d549328a386aedb836a85a31a5114edef4f5ae04d1e9597b3","observation_id":"01ec6ab3-dba8-4423-a9a4-f05e5b4d0186","resolution":{"observed_at":"2026-08-06T23:00:45.965958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T23:00:45.969632Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.969632Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:34ead7876313db74ae34731f2f46fcd91126ebc8400d5a91dd066777005f2cbe","observation_id":"da0df22c-2792-421a-813d-1f42414d183b","resolution":{"observed_at":"2026-08-06T23:00:45.969632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T23:00:45.972704Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.972704Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:825791033e7dd9dcd9f3d4052c4e778c336a66277ed27b9df7b0e1251ba795b2","observation_id":"5680a04d-81fc-49b7-903a-969de894eacc","resolution":{"observed_at":"2026-08-06T23:00:45.972704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:45.975727Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.975727Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:24436baf99de023f738f6028b7566c09feb0e19c10402d3c2e7f493e3fd374af","observation_id":"013d035e-3640-449a-b09d-7a2b16054c46","resolution":{"observed_at":"2026-08-06T23:00:45.975727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03716","last_updated":"2024-07-10T23:15:49Z","snapshot_observed_at":"2026-08-03T14:09:43.107865Z","submitted_at":"2023-10-05T17:38:28Z","title":"A Long Way to Go: Investigating Length Correlations in RLHF","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03716","snapshot_observed_at":"2026-08-06T23:00:45.978822Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.978822Z"},"links":{"cited_paper":"/paper/2310.03716","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:9f15ea6755953e777689da13c1914622239d77290fb1eee44d202c63b3ad5b2e","observation_id":"73af5cdd-1b0c-49a1-ad4f-8d4ee91000e7","resolution":{"observed_at":"2026-08-06T23:00:45.978822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-06T23:00:45.981739Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.981739Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:f29d6d3b0640ee2691e608b7031b3386d654760136de0eb9060782cae9e5cb3c","observation_id":"2174a9ed-70da-44e2-b8a5-fd7b4ef85990","resolution":{"observed_at":"2026-08-06T23:00:45.981739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-10T17:28:59.378726Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-06T23:00:45.985276Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.985276Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:f77727658a16c567cd2a50152debcf1eb44439bf939b34761c5987d5ab74ff0a","observation_id":"d33cdebf-6fe4-4c04-8420-fbbc123ce694","resolution":{"observed_at":"2026-08-06T23:00:45.985276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:46.494135Z","title":null,"venue":null,"work_id":"c149899a-5105-467e-bf8c-1641249d3d5d","year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.988318Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:1d30089b912b0ee0b33748011a7d88113ddc7b69a85b15be329f58000854fa4e","observation_id":"bdd5cc72-defb-4ab4-83bd-5fc1d5590200","resolution":{"observed_at":"2026-08-06T23:00:46.498123Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:45.991290Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.991290Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:843882d3237099ccdb1fcb666eea6f1b1a4c450d677cbf50b3bcb04655b17d19","observation_id":"bb1390ef-1d8f-4b31-a3e4-09f926b61d61","resolution":{"observed_at":"2026-08-06T23:00:45.991290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14768","last_updated":"2025-02-20T17:49:26Z","snapshot_observed_at":"2026-08-04T12:32:53.090165Z","submitted_at":"2025-02-20T17:49:26Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14768","snapshot_observed_at":"2026-08-06T23:00:45.994143Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.994143Z"},"links":{"cited_paper":"/paper/2502.14768","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:27d9479a3993696e495ecf40a4b7203c4caf9e751aca956c07bf777dc0579df9","observation_id":"586de41a-4eda-4c63-8d24-d71123b0f776","resolution":{"observed_at":"2026-08-06T23:00:45.994143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-07T17:49:06.764625Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-06T23:00:45.997171Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.997171Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:63027d076b13a898deafdaef0bc8b4378a77ff531d6ba3d905aa5a9033cd6af0","observation_id":"be903c9c-f430-4240-9273-57a3ac2a220f","resolution":{"observed_at":"2026-08-06T23:00:45.997171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12134","last_updated":"2025-05-27T14:54:51Z","snapshot_observed_at":"2026-08-07T18:11:21.121498Z","submitted_at":"2025-02-17T18:52:29Z","title":"SoftCoT: Soft Chain-of-Thought for Efficient Reasoning with LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12134","snapshot_observed_at":"2026-08-06T23:00:46.000277Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:46.000277Z"},"links":{"cited_paper":"/paper/2502.12134","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:68fdce5646ee192de56abc830d939cd21f0beaa1554d43b0e771d542158a9b19","observation_id":"a0b0adeb-d9eb-4aa4-a2de-3b39ae992cd8","resolution":{"observed_at":"2026-08-06T23:00:46.000277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-06T23:00:46.003373Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:46.003373Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:1350e52d43c5e5a47cc4af077a2dceea4b4d1731a61abb816b6516846dce4fbc","observation_id":"c8520840-ecac-4902-af23-f715669b8f1c","resolution":{"observed_at":"2026-08-06T23:00:46.003373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-07-06T20:31:41.231839Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-06T23:00:46.006441Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:46.006441Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:66c6d3661ae93199242adbf7c408fe53f5c69f730b1c2aaaff6896874bf803ec","observation_id":"f23292b8-40c2-479e-8528-627182226e2c","resolution":{"observed_at":"2026-08-06T23:00:46.006441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-06T23:00:46.009533Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:46.009533Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:cc16a0ca2783d0bcbea130705383f2ed56a54c84ba7916fa23a32ef5d018f869","observation_id":"99bbdf07-81ba-4a53-b0b2-6281b18b62f8","resolution":{"observed_at":"2026-08-06T23:00:46.009533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:46.012857Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:46.012857Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:09c5c1cf6535645faa8c7d85c627f80f78fa3c83d6d53fff0a93a0a479008c14","observation_id":"5fffbe27-ff66-48bf-8c31-0a0babefdc1d","resolution":{"observed_at":"2026-08-06T23:00:46.012857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:46.016123Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:46.016123Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:78c98fdff958ca6e9c0eb6598e7b35dc7e3c505767f4d8fd22a70c7681e72b89","observation_id":"8fe7e63c-9129-4915-b5da-a4355ac9346d","resolution":{"observed_at":"2026-08-06T23:00:46.016123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T21:06:17.179483Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 3 inbound Pith citation observations for arXiv:2506.20160."}