{"as_of":"2026-08-09T20:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ae9cabc30534ac7fbf98829c17fac2484a0b47a7f81c97a28c979dca33254202","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:17:40.289683Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19962/citation-record","integrity":"/paper/2607.19962/integrity","json":"/paper/2607.19962/citation-record.json","paper":"/paper/2607.19962"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:17:40.195703Z","title":"Sketch-of-thought: Efficient LLM rea- soning with adaptive cognitive-inspired sketching","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.195703Z"},"links":{"citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:bc09bf05a67cb87d7781f6062aa225f0be2381d1d8aa431814d89919dd6522f6","observation_id":"cb855382-5745-4d62-98f3-66af94cc6b88","resolution":{"observed_at":"2026-08-01T11:17:40.195703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14755","last_updated":"2025-09-11T02:13:24Z","snapshot_observed_at":"2026-08-07T00:07:24.304900Z","submitted_at":"2025-06-17T17:50:16Z","title":"Optimizing Length Compression in Large Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14755","snapshot_observed_at":"2026-08-01T11:17:40.210209Z","title":"Optimizing length compression in large reasoning models.arXiv preprint arXiv:2506.14755,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.210209Z"},"links":{"cited_paper":"/paper/2506.14755","citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:5d3cd97865c306a7896ebdf7e3f333773255b606e1f53f872ef35cda6411fd28","observation_id":"5b0eb710-8d34-4a72-aadd-14e25293efe4","resolution":{"observed_at":"2026-08-01T11:17:40.210209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08235","last_updated":"2025-02-12T09:23:26Z","snapshot_observed_at":"2026-08-08T15:07:58.178948Z","submitted_at":"2025-02-12T09:23:26Z","title":"The Danger of Overthinking: Examining the Reasoning-Action Dilemma in Agentic Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08235","snapshot_observed_at":"2026-08-01T11:17:40.215084Z","title":"The danger of overthinking: Examin- ing the reasoning-action dilemma in agentic tasks.arXiv preprint arXiv:2502.08235,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.215084Z"},"links":{"cited_paper":"/paper/2502.08235","citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:be136dba0fd62812d47da7e15a7e84ef3ac438747ca4697c95d5c38077214b2e","observation_id":"d1a0ecba-065e-4ee2-9176-c567615d9f1c","resolution":{"observed_at":"2026-08-01T11:17:40.215084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-01T11:17:40.220113Z","title":"Deepseek-r1: In- centivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.220113Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:fc7138be6d6e91c0ed825de6ab3c92f957f3332349fe602ca905f86ef6c7cfba","observation_id":"f07cc2cf-ff5d-46e0-af9f-dc1de20e1401","resolution":{"observed_at":"2026-08-01T11:17:40.220113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:17:40.224760Z","title":"Token- budget-aware llm reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.224760Z"},"links":{"citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:a4872a5ecc7c936119573f8b41371442cd709b4641e903fdd8d547584ba6c216","observation_id":"85cb031e-917b-4801-a3ca-3083afc79230","resolution":{"observed_at":"2026-08-01T11:17:40.224760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:17:40.229399Z","title":"Measuring mathemat- ical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.229399Z"},"links":{"citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:5d86ca21e16966aa69376bec5efac3f48ea8f809fa2ce3a51396e3d16d4d19c0","observation_id":"40955301-8fd3-4990-85b5-e3de72f17479","resolution":{"observed_at":"2026-08-01T11:17:40.229399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14852","last_updated":"2023-12-27T10:09:18Z","snapshot_observed_at":"2026-07-06T17:07:14.412645Z","submitted_at":"2023-12-22T17:25:42Z","title":"TACO: Topics in Algorithmic COde generation dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14852","snapshot_observed_at":"2026-08-01T11:17:40.237963Z","title":"Taco: Topics in algorithmic code generation dataset.arXiv preprint arXiv:2312.14852,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.237963Z"},"links":{"cited_paper":"/paper/2312.14852","citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:8c76a8537ee06f75a30f5973416f2b3d6ecc51ee9e248e49958b1b7a65825b7b","observation_id":"6b2bb410-a8d6-4927-bb03-a392866cb7eb","resolution":{"observed_at":"2026-08-01T11:17:40.237963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12570","last_updated":"2025-01-29T03:11:03Z","snapshot_observed_at":"2026-08-08T03:22:47.699927Z","submitted_at":"2025-01-22T01:35:11Z","title":"O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12570","snapshot_observed_at":"2026-08-01T11:17:40.247507Z","title":"O1-pruner: Length-harmonizing fine- tuning for o1-like reasoning pruning.arXiv preprint arXiv:2501.12570,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.247507Z"},"links":{"cited_paper":"/paper/2501.12570","citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:f1ff5340435a13a480aabab115b9cb6eeede3c970724d2b7d4455e62b30f204f","observation_id":"cda6ec71-ed17-418c-86d5-1055d6e3b994","resolution":{"observed_at":"2026-08-01T11:17:40.247507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09858","last_updated":"2025-04-14T04:08:16Z","snapshot_observed_at":"2026-08-08T01:06:59.135762Z","submitted_at":"2025-04-14T04:08:16Z","title":"Reasoning Models Can Be Effective Without Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09858","snapshot_observed_at":"2026-08-01T11:17:40.252219Z","title":"[Maet al., 2025 ] Wenjie Ma, Jingxuan He, Charlie Snell, Tyler Griggs, Sewon Min, and Matei Zaharia","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.252219Z"},"links":{"cited_paper":"/paper/2504.09858","citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:694b7ea65aa64f4d904a1dd2ce167597af9520636ffb7ee66cb7ccc1a1ef5f19","observation_id":"7fdbc693-ab41-4104-9c81-3107b4d03b6b","resolution":{"observed_at":"2026-08-01T11:17:40.252219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:17:40.256620Z","title":"s1: Simple test-time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.256620Z"},"links":{"citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:e8f83c0d4f93b0218300bd9e17339ecb3bb5e588526474d8891bf9f275d52b98","observation_id":"8d2a359f-7229-4e3d-86bb-070bc164659f","resolution":{"observed_at":"2026-08-01T11:17:40.256620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:17:40.260565Z","title":"DynaThink: Fast or slow? a dynamic decision-making framework for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.260565Z"},"links":{"citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:22ef911b9b9a25ff39d4b66417932b912274f7f38f960d32bd717ee7d95572e4","observation_id":"3e1b069d-8157-49fc-b506-eadc9e2da592","resolution":{"observed_at":"2026-08-01T11:17:40.260565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:17:40.264612Z","title":"Direct preference optimization: Your lan- guage model is secretly a reward model.Advances in neural information processing systems, 36:53728–53741,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.264612Z"},"links":{"citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:60dfd988580551a247a9227159c7b07413b4f30313d64be67bdef1b274f08878","observation_id":"302028a2-a39b-41e6-9985-742e17983424","resolution":{"observed_at":"2026-08-01T11:17:40.264612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:17:40.268664Z","title":"DAST: Difficulty-adaptive slow-thinking for large reasoning mod- els","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.268664Z"},"links":{"citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:cb0e2705b6d5aecad24da73f94f551c45fa4869379419bb363e771b9e9bd4305","observation_id":"23dbda9e-4e0d-4b86-b021-aec00b4b198b","resolution":{"observed_at":"2026-08-01T11:17:40.268664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:17:40.272856Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.272856Z"},"links":{"citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:a660a9ff442e5f3740a3f67f5b00e4adc4a8d310a5cc2e66ed36bcdd6073ccaa","observation_id":"30e244d6-2465-44ff-871a-4d845bddc279","resolution":{"observed_at":"2026-08-01T11:17:40.272856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:17:40.276719Z","title":"Dualformer: Controllable fast and slow thinking by learning with ran- domized reasoning traces","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.276719Z"},"links":{"citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:dbb2e290a8bdf48ea7c004bd288ef2e952638c1884e1bc76e18c41e30c5e87cc","observation_id":"e7a233f3-2f83-4bfc-bda6-5be9a1c1717c","resolution":{"observed_at":"2026-08-01T11:17:40.276719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-01T11:17:40.280865Z","title":"Stop overthinking: A survey on efficient reasoning for large lan- guage models.arXiv preprint arXiv:2503.16419,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.280865Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:704ea14121feeb91fb1720bcbbf9485b485ca1f6fd62d8e1baf75721e725d3b9","observation_id":"c3ba12e7-a5dc-432a-a7e5-b3dc1b750f5b","resolution":{"observed_at":"2026-08-01T11:17:40.280865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-01T11:17:40.285036Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.285036Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:0aa6704a2a97abe61a52d5e8c1a0e6b70f78b340b70bacbc8fa666c2ec92343b","observation_id":"810116fd-8204-4e41-ae84-f2225e54129a","resolution":{"observed_at":"2026-08-01T11:17:40.285036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-01T11:17:40.289683Z","title":"Qwen2.5 technical report.arXiv preprint arXiv:2412.15115, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.289683Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:05e8da2a3c18a49bd6dc38f980a82c892e50c0d2378f158092b3c55ad7b35ccf","observation_id":"c3aaf4ff-c0b0-4533-bbfe-1c9a075eb16c","resolution":{"observed_at":"2026-08-01T11:17:40.289683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01296","last_updated":"2025-04-02T01:59:26Z","snapshot_observed_at":"2026-07-30T08:40:23.849282Z","submitted_at":"2025-04-02T01:59:26Z","title":"ThinkPrune: Pruning Long Chain-of-Thought of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01296","snapshot_observed_at":"2026-08-01T11:17:40.233585Z","title":"Thinkprune: Pruning long chain-of-thought of llms via re- inforcement learning.arXiv preprint arXiv:2504.01296,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.233585Z"},"links":{"cited_paper":"/paper/2504.01296","citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:d52d6f80a10f13750fbdf69767974fa6572c3236ef763d9fe8f652bd5503408d","observation_id":"0d0c6014-004c-4ee5-af98-36920e3e0d16","resolution":{"observed_at":"2026-08-01T11:17:40.233585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:17:40.243121Z","title":"ThinkSwitcher: When to think hard, when to think fast","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.243121Z"},"links":{"citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:0bdef7624fd39fc1dafccb27048f87bdce0716a335bf0b972ad24934210e6214","observation_id":"41d58f43-6f89-4885-aa6a-76213e83e346","resolution":{"observed_at":"2026-08-01T11:17:40.243121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:17:40.205564Z","title":"The overthinker’s DIET: Cutting token calories with DIfficulty-aware training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.205564Z"},"links":{"citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:e681f988799582e102025900de8560058714b06a7f68a9e9421a44742c42a795","observation_id":"4746e66a-7f39-47a5-98a7-f34fbf85603e","resolution":{"observed_at":"2026-08-01T11:17:40.205564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-01T11:17:40.200772Z","title":"Do not think that much for 2+ 3=? on the overthinking of o1-like llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T11:17:40.200772Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2607.19962"},"observation_digest":"sha256:a8032929ca872c06c7be5959c991459166e4892acce14e59f5a4988d6fab075a","observation_id":"4682635f-18ea-4e05-af52-36b22b0d716f","resolution":{"observed_at":"2026-08-01T11:17:40.200772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19962","last_updated":"2026-07-22T09:40:22Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T20:22:22.916584Z","submitted_at":"2026-07-22T09:40:22Z","title":"EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2607.19962."}