{"as_of":"2026-08-15T14:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4bb5a69e05d31e33514a3ef4140ad6f0db14bd3597cb8adeee573d0329eec37e","coverage":[{"denominator":104,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:36:06.449701Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:07:40.131808Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T07:41:00.572991Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14681","snapshot_observed_at":"2026-08-07T05:07:40.131808Z","title":"Two experts are all you need for steering thinking: Reinforcing cognitive effort in moe reasoning models without additional training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00004","last_updated":"2025-07-10T17:08:40Z","snapshot_observed_at":"2026-08-12T15:42:28.437403Z","submitted_at":"2025-06-10T14:47:48Z","title":"A Theory of Inference Compute Scaling: Reasoning through Directed Stochastic Skill Search","version":2},"reference_index":154,"source":"pdf_text","source_observed_at":"2026-08-07T05:07:40.131808Z"},"links":{"cited_paper":"/paper/2505.14681","citing_paper":"/paper/2507.00004"},"observation_digest":"sha256:6bc52e4b8ffc6c79a3c4f5ca9a705985609a825fc91576b43f8224ec8365d473","observation_id":"c96cd297-107c-456c-9eca-5663d38c3af8","resolution":{"observed_at":"2026-08-07T05:07:40.131808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"cited_work":{"arxiv_id":"2505.14681","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14681","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mengru Wang, Xingyu Chen, Yue Wang, Zhiwei He, Jiahao Xu, Tian Liang, Qiuzhi Liu, Yunzhi Yao, Wenxuan Wang, Ruotian Ma, and 1 others","venue":null,"work_id":"465a9f03-68ab-4d28-b2e3-2a1587252bfd","year":2024},"citing_paper":{"arxiv_id":"2604.08541","last_updated":"2026-04-09T17:59:44Z","snapshot_observed_at":"2026-08-11T07:19:48.366136Z","submitted_at":"2026-04-09T17:59:44Z","title":"Seeing but Not Thinking: Routing Distraction in Multimodal Mixture-of-Experts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T17:03:13.911088Z"},"links":{"cited_paper":"/paper/2505.14681","citing_paper":"/paper/2604.08541"},"observation_digest":"sha256:1c71fedbab758fb0abe93465ac350f72be76b1307e5fd60f06edd93ab854a8f1","observation_id":"176c6ba5-f8f2-41c5-a893-faa59179945f","resolution":{"observed_at":"2026-05-11T07:41:00.574736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14681/citation-record","integrity":"/paper/2505.14681/integrity","json":"/paper/2505.14681/citation-record.json","paper":"/paper/2505.14681"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:36:06.097425Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.097425Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:56d08a762ebdf9c4261aaa5313e14ae12e0a991d28e61c82d88ad3a46ef66480","observation_id":"dde255fb-69d9-47bf-93b2-26ae663bc741","resolution":{"observed_at":"2026-08-07T15:36:06.097425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.101934Z","title":"Qwen3: Think deeper, act faster","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.101934Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:c4c7821819dc50d356c9a3fe357c3cf143f22979fde9cb67c447609bc6b3d7d4","observation_id":"3b1004d0-8e86-4ba0-acc9-a77fabcfbf68","resolution":{"observed_at":"2026-08-07T15:36:06.101934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-07T15:36:06.106030Z","title":"Do NOT think that much for 2+3=? on the overthinking of o1-like llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.106030Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:11bace8a11682038484b83f0ba1816f9330664f5fbdca04704d42bca8e43d93a","observation_id":"7cb870a0-b175-494b-89ab-175ec8b24a55","resolution":{"observed_at":"2026-08-07T15:36:06.106030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-08-15T06:19:06.009960Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-07T15:36:06.109851Z","title":"Thoughts are all over the place: On the underthinking of o1-like llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.109851Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:e56349516503de94e3cdd45c051b9433d4e9adae28fac00e0c62961d9c42e828","observation_id":"c0db09e6-e810-44d4-abf1-02bfcfc35d30","resolution":{"observed_at":"2026-08-07T15:36:06.109851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T15:36:06.113465Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.113465Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:2dd1e8b208fe4db5309e7e88362c669654540d9c728bf1fcff17e3272b306765","observation_id":"4783dcac-fb81-4275-ae38-5fd299f47c15","resolution":{"observed_at":"2026-08-07T15:36:06.113465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02497","last_updated":"2025-06-29T06:49:52Z","snapshot_observed_at":"2026-08-14T11:34:40.539520Z","submitted_at":"2025-01-05T10:24:20Z","title":"A Survey of Test-Time Compute: From Intuitive Inference to Deliberate Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02497","snapshot_observed_at":"2026-08-07T15:36:06.117726Z","title":"Test-time computing: from system-1 thinking to system-2 thinking","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.117726Z"},"links":{"cited_paper":"/paper/2501.02497","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:8d26d5f8ba641c38426c98fc74334ff13d616056104c834dd5d5ee50adcd2e76","observation_id":"4e3c4d21-5be9-48e6-b420-5b18ebe0fa3d","resolution":{"observed_at":"2026-08-07T15:36:06.117726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24235","last_updated":"2025-05-04T15:48:08Z","snapshot_observed_at":"2026-08-14T20:42:45.858130Z","submitted_at":"2025-03-31T15:46:15Z","title":"A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24235","snapshot_observed_at":"2026-08-07T15:36:06.123183Z","title":"What, how, where, and how well? a survey on test-time scaling in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.123183Z"},"links":{"cited_paper":"/paper/2503.24235","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:b7fa0bd23130e4ac3b3c7078f16ad300781b012b859abc1f69a83bcb40569c32","observation_id":"7fe73304-4756-4f24-9074-56cf2419473f","resolution":{"observed_at":"2026-08-07T15:36:06.123183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-11T13:10:23.709172Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-07T15:36:06.126406Z","title":"Stop overthinking: A survey on efficient reasoning for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.126406Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:74d38b8be0ad26c1773d33820583d45c4afa0917ca5e52c275207a8fe11802b0","observation_id":"57d758f3-1b97-4d4c-9d63-46d981c56be9","resolution":{"observed_at":"2026-08-07T15:36:06.126406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.129950Z","title":"Efficient reasoning models: A survey","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.129950Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:6ec1550772756b60b4c61aedef71aae899882674e0f243e60686c2f3c2760c9f","observation_id":"81a47dd3-d873-4495-8988-dc53c18df9fa","resolution":{"observed_at":"2026-08-07T15:36:06.129950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02665","last_updated":"2025-05-08T05:27:18Z","snapshot_observed_at":"2026-08-13T13:53:38.420021Z","submitted_at":"2025-05-05T14:14:59Z","title":"A Survey of Slow Thinking-based Reasoning LLMs using Reinforced Learning and Inference-time Scaling Law","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02665","snapshot_observed_at":"2026-08-07T15:36:06.133968Z","title":"A survey of slow thinking-based reasoning llms using reinforced learning and inference-time scaling law","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.133968Z"},"links":{"cited_paper":"/paper/2505.02665","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:f4edd8b52d4131437aaf3ddf098ee25cc551a23be520c10455719a12bbf2feab","observation_id":"06417ac6-4910-4b6a-9e4d-268a7dda7ebb","resolution":{"observed_at":"2026-08-07T15:36:06.133968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.137934Z","title":"A survey of efficient reasoning for large reasoning models: Language, multimodality, and beyond","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.137934Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:824efa5ac31c16fd91eea8e8b1a1a9862a83cef1c0fd378b1f24a597568b2c4b","observation_id":"ae20b146-0fc1-4cc3-af29-4eb8d57cdb3f","resolution":{"observed_at":"2026-08-07T15:36:06.137934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-07T15:36:06.140959Z","title":"Towards reasoning era: A survey of long chain-of-thought for reasoning large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.140959Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:2eb812af4120b40796c6fafd576faa616c7916921104a7db9149812c882a03d2","observation_id":"f65cceea-64dd-4e52-a487-2a64bd7ad22d","resolution":{"observed_at":"2026-08-07T15:36:06.140959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24377","last_updated":"2025-03-31T17:58:07Z","snapshot_observed_at":"2026-08-12T17:17:28.011053Z","submitted_at":"2025-03-31T17:58:07Z","title":"Harnessing the Reasoning Economy: A Survey of Efficient Reasoning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24377","snapshot_observed_at":"2026-08-07T15:36:06.144176Z","title":"Harnessing the reasoning economy: A survey of efficient reasoning for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.144176Z"},"links":{"cited_paper":"/paper/2503.24377","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:d71a10d4afb46d71c235fa56dbe8a54c35d9685b9c4b3ed9f5d8194cf8475079","observation_id":"d505850f-8613-428d-92aa-6b3fe65699c6","resolution":{"observed_at":"2026-08-07T15:36:06.144176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24370","last_updated":"2025-05-21T17:51:27Z","snapshot_observed_at":"2026-08-07T16:20:08.878901Z","submitted_at":"2025-03-31T17:50:13Z","title":"Effectively Controlling Reasoning Models through Thinking Intervention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24370","snapshot_observed_at":"2026-08-07T15:36:06.148359Z","title":"Effectively controlling reasoning models through thinking intervention","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.148359Z"},"links":{"cited_paper":"/paper/2503.24370","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:ad60554cb1ffe69dd29f487d2e8658b22122aaf6494a4300ea4315e59724cbf2","observation_id":"b60d7ca0-91c5-4675-9c4f-cf8428f4c72a","resolution":{"observed_at":"2026-08-07T15:36:06.148359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04383","last_updated":"2025-04-15T14:07:31Z","snapshot_observed_at":"2026-08-10T20:21:55.932155Z","submitted_at":"2025-04-06T06:23:27Z","title":"Retro-Search: Exploring Untaken Paths for Deeper and Efficient Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04383","snapshot_observed_at":"2026-08-07T15:36:06.152249Z","title":"Retro-search: Exploring untaken paths for deeper and efficient reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.152249Z"},"links":{"cited_paper":"/paper/2504.04383","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:8d7f011e098d18ec04b8e70ceb57abd0ad5122054137ad87602c687e55fc2c2f","observation_id":"8a37d5ae-d437-49e7-b5da-fe587ff80238","resolution":{"observed_at":"2026-08-07T15:36:06.152249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-08-13T15:18:04.411100Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06066","snapshot_observed_at":"2026-08-07T15:36:06.155796Z","title":"Deepseekmoe: Towards ultimate expert specialization in mixture-of-experts language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.155796Z"},"links":{"cited_paper":"/paper/2401.06066","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:29e02c719966c85e65fc21b38af1b1db8e120fe94a8e1181d053e4972667e211","observation_id":"b8c25046-715d-449f-a15b-5b191ea71827","resolution":{"observed_at":"2026-08-07T15:36:06.155796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T15:36:06.159139Z","title":"Zhang, Han Bao, Hanwei Xu, Haocheng Wang, Haowei Zhang, Honghui Ding, Huajian Xin, Huazuo Gao, Hui Li, Hui Qu, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.159139Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:297301d9cede9591758201d0ea08da5c69296287e0874f58021c47407977db9c","observation_id":"0dc9d088-f9ff-4413-bb47-904575b278b9","resolution":{"observed_at":"2026-08-07T15:36:06.159139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.162750Z","title":"Openmoe: An early effort on open mixture-of-experts language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.162750Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:d62655edbe3d7af263e53c51fa6bca81bdc0f0e7f000d544936e71942b705535","observation_id":"c206e5a1-23d3-4b36-8897-683c6425109e","resolution":{"observed_at":"2026-08-07T15:36:06.162750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.165766Z","title":"Working memory revived in older adults by synchronizing rhythmic brain circuits","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.165766Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:8f85727f45bc51f7d35cf4f0f44a54cce07af11065341da30f37add126c5e5e0","observation_id":"c990ef0d-fcc4-4993-9f05-81e58639c231","resolution":{"observed_at":"2026-08-07T15:36:06.165766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.168743Z","title":"Neurocognitive, physiological, and biophysical effects of transcranial alternating current stimulation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.168743Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:12442acf59050f29ae63a80c615be2c200f042dd53888746348a0e1bd5fc1434","observation_id":"6b7a775e-ae93-4b40-8181-20ffd9316f43","resolution":{"observed_at":"2026-08-07T15:36:06.168743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.172423Z","title":"Non-invasively targeting, probing and modulating a deep brain circuit for depression alleviation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.172423Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:fe107f27c027254ddd86a3fa188e7c52328c4c29e3bdb1cd0fd1860617955e6d","observation_id":"d17cbb26-00f2-4e3f-a922-56a8d91ed203","resolution":{"observed_at":"2026-08-07T15:36:06.172423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.175651Z","title":"High-frequency neuromodulation improves obsessive--compulsive behavior","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.175651Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:b992c99275ea0e3b948612a2c6c88df1e370dd1809cc0aecb9df80f9d068d4db","observation_id":"b1184e70-71e2-4c89-b1b1-522fdb5efd50","resolution":{"observed_at":"2026-08-07T15:36:06.175651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.179680Z","title":"Normalized (pointwise) mutual information in collocation extraction","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.179680Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:f76b7ddf4fc759b1d066ef55e5bdd9875ce727e8b7608f1333825d2a67c8163c","observation_id":"545a8398-fcec-43c7-b945-6dee6d11de97","resolution":{"observed_at":"2026-08-07T15:36:06.179680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10928","last_updated":"2025-05-21T16:32:41Z","snapshot_observed_at":"2026-08-07T18:15:24.710321Z","submitted_at":"2025-02-15T23:37:32Z","title":"Probing Semantic Routing in Large Mixture-of-Expert Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10928","snapshot_observed_at":"2026-08-07T15:36:06.182908Z","title":"Semantic specialization in moe appears with scale: A study of deepseek r1 expert specialization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.182908Z"},"links":{"cited_paper":"/paper/2502.10928","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:78b47ab89deab8f85299dea24f8ee20f02fd1df706ca8e167bc398df4f0ca3f7","observation_id":"1a989082-7d23-4866-bb14-cfc11d4a0626","resolution":{"observed_at":"2026-08-07T15:36:06.182908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.187353Z","title":"Aime problems and solutions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.187353Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:72e65c8c670f98c6e727185dc1c21c6870533417a70370cc4be0a5eddb92697e","observation_id":"f5dcdb0a-850b-4959-afec-a43d3f4b3289","resolution":{"observed_at":"2026-08-07T15:36:06.187353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.191573Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.191573Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:693e5f352550a0a1f8fe952c210ef73e9b2fa11e6e758a6e585f64188b71a96b","observation_id":"4bdc1b01-9dba-49fc-89cb-5c654b19086f","resolution":{"observed_at":"2026-08-07T15:36:06.191573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-11T09:34:38.920981Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-07T15:36:06.195570Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.195570Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:d776e1c6597e988f08a641f91aa2055430dd575b4d8fd3f8272ed286f230a15c","observation_id":"c7d0f578-3ee1-4e05-a0dc-10afd508885d","resolution":{"observed_at":"2026-08-07T15:36:06.195570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13828","last_updated":"2025-04-28T12:41:07Z","snapshot_observed_at":"2026-08-07T16:01:03.024938Z","submitted_at":"2025-04-18T17:55:58Z","title":"Generative AI Act II: Test Time Scaling Drives Cognition Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13828","snapshot_observed_at":"2026-08-07T15:36:06.199466Z","title":"Generative ai act ii: Test time scaling drives cognition engineering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.199466Z"},"links":{"cited_paper":"/paper/2504.13828","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:9b56174aa609c2622c08e26ad6a55e26f1f28ed57d97ea348b389fd10cfa2043","observation_id":"a8d377b7-92dc-41a7-bb44-ead145118e50","resolution":{"observed_at":"2026-08-07T15:36:06.199466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.203634Z","title":"Qwq: Reflect deeply on the boundaries of the unknown","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.203634Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:db5c396fbd5d105d8334d0222f2878f19297cc5b59a16436a8ee20f10d516be2","observation_id":"e50066b5-1817-45f6-a1cd-4897491e5557","resolution":{"observed_at":"2026-08-07T15:36:06.203634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.206752Z","title":"Claude 3.7 sonnet","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.206752Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:1afeac93b1de13e8fa3dfb2c16085ec8a3a001b092016d21298d6f708ee62f38","observation_id":"874b3349-7f6b-497e-b1ae-1d942749facb","resolution":{"observed_at":"2026-08-07T15:36:06.206752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-11T01:31:26.242281Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T15:36:06.210382Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.210382Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:3555e6f626628d628609e1dcea5f4a1ab385fb660a6133435cb561dc1dfaecfb","observation_id":"8843a690-5b26-41b2-ad6e-60025642029c","resolution":{"observed_at":"2026-08-07T15:36:06.210382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.213155Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.213155Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:d93cd344650d51ab9b67068b483d8fba09a9667d0d0b1231c7648ca572126719","observation_id":"cea28f27-83b8-4804-a994-4846600618d7","resolution":{"observed_at":"2026-08-07T15:36:06.213155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.216185Z","title":"The llama 4 herd: The beginning of a new era of natively multimodal ai innovation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.216185Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:4c04bc5b70d1bb4d74074f6c5da03425465ca301810ff616569283fe29e76e3f","observation_id":"1f6994b1-f328-45bc-8184-b65ecc33ec7a","resolution":{"observed_at":"2026-08-07T15:36:06.216185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02060","last_updated":"2025-03-03T01:25:46Z","snapshot_observed_at":"2026-08-15T00:07:51.079800Z","submitted_at":"2024-09-03T17:08:20Z","title":"OLMoE: Open Mixture-of-Experts Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02060","snapshot_observed_at":"2026-08-07T15:36:06.219070Z","title":"Smith, Pang Wei Koh, Amanpreet Singh, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.219070Z"},"links":{"cited_paper":"/paper/2409.02060","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:cdefab4fd436000726c210723102cc4b7ebd9e58eb68edf6defc06a3dbb49d8b","observation_id":"1d150de9-74ed-4206-9810-1cea3a9a15db","resolution":{"observed_at":"2026-08-07T15:36:06.219070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.222795Z","title":"Le, Geoffrey E","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.222795Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:a9ec972a52807a48d6b39154f25f4d9fc9a3578a47d27f58fa864da040604afc","observation_id":"9d1d7fcb-05d2-45dd-96bc-5ae5793625d6","resolution":{"observed_at":"2026-08-07T15:36:06.222795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11096","last_updated":"2025-02-16T12:24:39Z","snapshot_observed_at":"2026-08-13T06:13:40.698035Z","submitted_at":"2025-02-16T12:24:39Z","title":"Mixture of Tunable Experts -- Behavior Modification of DeepSeek-R1 at Inference Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11096","snapshot_observed_at":"2026-08-07T15:36:06.226587Z","title":"Mixture of tunable experts--behavior modification of deepseek-r1 at inference time","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.226587Z"},"links":{"cited_paper":"/paper/2502.11096","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:6f6681c319cd5a8cc456b2d93362b052dcf4003158b8990c9e51484c846d4c44","observation_id":"11723429-ce56-481e-bf43-948f023e8b90","resolution":{"observed_at":"2026-08-07T15:36:06.226587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.230426Z","title":"Under the hood of a reasoning model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.230426Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:48b01b9c69ad4348f5acf83ac9bc1b12c4708d8268798628249ea1606859ddc3","observation_id":"a2c38890-4b3d-4cbf-8d23-c8c4b35b65ec","resolution":{"observed_at":"2026-08-07T15:36:06.230426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-11T13:10:23.709172Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-07T15:36:06.233904Z","title":"Stop overthinking: A survey on efficient reasoning for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.233904Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:25807aab672fcc1214b6e673b8ae4ae916a3116063fa29914cb00be4f86c635d","observation_id":"fdff6091-894d-47a2-9361-38318dccc481","resolution":{"observed_at":"2026-08-07T15:36:06.233904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08235","last_updated":"2025-02-12T09:23:26Z","snapshot_observed_at":"2026-08-13T20:05:34.411750Z","submitted_at":"2025-02-12T09:23:26Z","title":"The Danger of Overthinking: Examining the Reasoning-Action Dilemma in Agentic Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08235","snapshot_observed_at":"2026-08-07T15:36:06.237359Z","title":"Gonzalez","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.237359Z"},"links":{"cited_paper":"/paper/2502.08235","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:42afba5811e216a8e27ec27513aa4ccb007d41c12407570a4d0ee019e23254ea","observation_id":"3599f3c2-c32f-4c1b-9b91-08c8c01615e6","resolution":{"observed_at":"2026-08-07T15:36:06.237359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18841","last_updated":"2025-01-31T01:20:44Z","snapshot_observed_at":"2026-08-13T21:17:14.276602Z","submitted_at":"2025-01-31T01:20:44Z","title":"Trading Inference-Time Compute for Adversarial Robustness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18841","snapshot_observed_at":"2026-08-07T15:36:06.241064Z","title":"Trading inference-time compute for adversarial robustness","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.241064Z"},"links":{"cited_paper":"/paper/2501.18841","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:2cf21a9391a6a1d23312ee86dbbde359a9376c021370b24df5ffbe27b5c97650","observation_id":"ca3d24b8-33bf-48f6-950d-d073526d2b13","resolution":{"observed_at":"2026-08-07T15:36:06.241064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15631","last_updated":"2026-07-07T09:54:57Z","snapshot_observed_at":"2026-08-12T10:29:16.645715Z","submitted_at":"2025-02-21T17:59:13Z","title":"The relationship between reasoning and performance in large language models--o3 (mini) thinks harder, not longer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15631","snapshot_observed_at":"2026-08-07T15:36:06.244296Z","title":"The relationship between reasoning and performance in large language models--o3 (mini) thinks harder, not longer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.244296Z"},"links":{"cited_paper":"/paper/2502.15631","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:71ef55259c582dc0d603ee8fd8769e533b276a33bf27b6502e69047c181ca302","observation_id":"fb42e7d4-88d1-4b98-a70c-9a1a12e0f147","resolution":{"observed_at":"2026-08-07T15:36:06.244296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10954","last_updated":"2025-02-18T03:41:03Z","snapshot_observed_at":"2026-08-14T01:05:39.970409Z","submitted_at":"2025-02-16T02:17:05Z","title":"Learning to Stop Overthinking at Test Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10954","snapshot_observed_at":"2026-08-07T15:36:06.248333Z","title":"Learning to stop overthinking at test time","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.248333Z"},"links":{"cited_paper":"/paper/2502.10954","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:171bcef24f9dbe9fd355e8cd3b83adb22c51d0759a305ab41cde3752d718d160","observation_id":"8b2b8ab6-f233-4d67-893c-1e784f71941c","resolution":{"observed_at":"2026-08-07T15:36:06.248333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16235","last_updated":"2025-02-27T06:39:06Z","snapshot_observed_at":"2026-08-07T17:56:27.359357Z","submitted_at":"2025-02-22T14:13:37Z","title":"Dynamic Parallel Tree Search for Efficient LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16235","snapshot_observed_at":"2026-08-07T15:36:06.251549Z","title":"Dynamic parallel tree search for efficient LLM reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.251549Z"},"links":{"cited_paper":"/paper/2502.16235","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:d9195caf21c9442bc6193e1f48855d4efd9bca98a534a9c135ab050f769e3df1","observation_id":"0eef2f8d-8868-4796-b00b-0a76d99d611e","resolution":{"observed_at":"2026-08-07T15:36:06.251549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06252","last_updated":"2025-03-08T15:23:47Z","snapshot_observed_at":"2026-08-13T23:17:23.624746Z","submitted_at":"2025-03-08T15:23:47Z","title":"Can Atomic Step Decomposition Enhance the Self-structured Reasoning of Multimodal Large Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06252","snapshot_observed_at":"2026-08-07T15:36:06.256005Z","title":"Can atomic step decomposition enhance the self-structured reasoning of multimodal large models? arXiv preprint arXiv:2503.06252, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.256005Z"},"links":{"cited_paper":"/paper/2503.06252","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:812e42182570aa2226a4b66c9e497e9894d83d3bf9c637dd1422ba276316f5fb","observation_id":"fa462b08-872f-457b-96c4-99548657c1f1","resolution":{"observed_at":"2026-08-07T15:36:06.256005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09858","last_updated":"2025-04-14T04:08:16Z","snapshot_observed_at":"2026-08-08T01:06:59.135762Z","submitted_at":"2025-04-14T04:08:16Z","title":"Reasoning Models Can Be Effective Without Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09858","snapshot_observed_at":"2026-08-07T15:36:06.259987Z","title":"Reasoning models can be effective without thinking","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.259987Z"},"links":{"cited_paper":"/paper/2504.09858","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:ca904b80e69957275df28f46d3d3f4cbc0064022810eb5aee920ccd3b79853db","observation_id":"a40f1f38-edaf-4ab6-b4b3-435222c6dbad","resolution":{"observed_at":"2026-08-07T15:36:06.259987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-14T11:38:51.383664Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T15:36:06.263321Z","title":"Cand \\` e s, and Tatsunori Hashimoto","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.263321Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:97e17c196b41d1add9fb57b1ca9baaa5728007cf302ab1c1d1e41c6083c9e34c","observation_id":"d26b707b-19cd-40f1-af7d-85666a99ddf2","resolution":{"observed_at":"2026-08-07T15:36:06.263321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18547","last_updated":"2025-06-02T00:44:09Z","snapshot_observed_at":"2026-08-13T10:37:12.511011Z","submitted_at":"2024-12-24T16:55:45Z","title":"Token-Budget-Aware LLM Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18547","snapshot_observed_at":"2026-08-07T15:36:06.266706Z","title":"Token-budget-aware LLM reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.266706Z"},"links":{"cited_paper":"/paper/2412.18547","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:d2265cf976e323a67d685f832849d6fc0a78f335ea8a6d8ab30f49a30c632d3f","observation_id":"e0de894f-502b-4ab2-9710-ef5f52d0ae58","resolution":{"observed_at":"2026-08-07T15:36:06.266706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.270087Z","title":"Aytes, Jinheon Baek, and Sung Ju Hwang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.270087Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:7a93b787b615bf17a8e2d55b23b657c40652712aa016efaa177f7cc9d5805e00","observation_id":"ddf7d854-3cc9-4a7e-a8b5-cc892e465656","resolution":{"observed_at":"2026-08-07T15:36:06.270087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.273270Z","title":"Lightthinker: Thinking step-by-step compression","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.273270Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:329c614db24cb4ef66a5031cf4cd628433cfe98faf59b0c8b1ed05bc8941810f","observation_id":"920b4382-3696-4fc2-a1c0-e3937411a2bd","resolution":{"observed_at":"2026-08-07T15:36:06.273270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.276350Z","title":"Seal: Steerable reasoning calibration of large language models for free","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.276350Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:26cbcee4ed969f4f5816daee0c52db82d9c3be806e604dcacb8a73cddf29a34c","observation_id":"59372352-24a5-439e-a24c-4eb217982bc5","resolution":{"observed_at":"2026-08-07T15:36:06.276350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17130","last_updated":"2025-08-11T17:20:44Z","snapshot_observed_at":"2026-08-13T12:45:44.312592Z","submitted_at":"2025-04-23T22:47:30Z","title":"Steering the CensorShip: Uncovering Representation Vectors for LLM \"Thought\" Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17130","snapshot_observed_at":"2026-08-07T15:36:06.279507Z","title":"thought","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.279507Z"},"links":{"cited_paper":"/paper/2504.17130","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:65e170d82f3026515e4ce79701e125f3f6b4995f409f7b1791569ff2e9d3bd10","observation_id":"211e0d5a-ec77-4f57-9028-ae44158348f6","resolution":{"observed_at":"2026-08-07T15:36:06.279507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.283460Z","title":"Thinkedit: Interpretable weight editing to mitigate overly short thinking in reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.283460Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:1f9893cbd9f94c3bf3824d7afad705465dde36006de726fadc88a858f8a15848","observation_id":"5de77e3d-851e-4323-808f-0ca3b53aa012","resolution":{"observed_at":"2026-08-07T15:36:06.283460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-07T15:36:06.287504Z","title":"LIMO: less is more for reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.287504Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:598e9793818571740873ea0a65011e99d136ee000c1788815c8702705698df49","observation_id":"06a73e45-0374-4964-984f-18b422e6f7fd","resolution":{"observed_at":"2026-08-07T15:36:06.287504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-15T06:09:25.789897Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-07T15:36:06.290884Z","title":"L1: controlling how long A reasoning model thinks with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.290884Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:55fb13f75cf05cd3ef14860d26113dc766669109b863c7f278473180e46cd41e","observation_id":"0bce3938-2fec-42c9-8b12-b0a81ee85ddd","resolution":{"observed_at":"2026-08-07T15:36:06.290884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-07T06:05:27.895209Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-07T15:36:06.294059Z","title":"Training large language models to reason in a continuous latent space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.294059Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:4674e836a552cfa5120cea2f447cd904a05b1b11a29cb79684438eed2fac063d","observation_id":"5ca71676-a3cc-45af-b056-808f460aa723","resolution":{"observed_at":"2026-08-07T15:36:06.294059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07964","last_updated":"2025-04-10T17:59:56Z","snapshot_observed_at":"2026-08-15T01:58:16.643201Z","submitted_at":"2025-04-10T17:59:56Z","title":"C3PO: Critical-Layer, Core-Expert, Collaborative Pathway Optimization for Test-Time Expert Re-Mixing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07964","snapshot_observed_at":"2026-08-07T15:36:06.297512Z","title":"C3po: Critical-layer, core-expert, collaborative pathway optimization for test-time expert re-mixing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.297512Z"},"links":{"cited_paper":"/paper/2504.07964","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:a8985a5d13b2484209227bb430dd18959426e2362a21efea18534f704b294738","observation_id":"9bab0c8e-bce7-46b5-aec0-628e49a04412","resolution":{"observed_at":"2026-08-07T15:36:06.297512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12359","last_updated":"2025-04-16T04:06:15Z","snapshot_observed_at":"2026-08-13T07:37:35.916467Z","submitted_at":"2025-04-16T04:06:15Z","title":"Unveiling Hidden Collaboration within Mixture-of-Experts in Large Language Models","version":1},"cited_work":{"arxiv_id":"2504.12359","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.12359","snapshot_observed_at":"2026-08-07T15:36:06.892396Z","title":"Unveiling Hidden Collaboration within Mixture-of-Experts in Large Language Models","venue":"cs.LG","work_id":"938a3c5e-1dd7-46c1-be01-a99739786cd6","year":2025},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.300609Z"},"links":{"cited_paper":"/paper/2504.12359","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:509b9df0b38803b5ad95572e92095b7412f36ac9e3c48b5ee8f48803d9521ad1","observation_id":"413e6c4f-a0ef-4bf0-8058-7d9f858e2d28","resolution":{"observed_at":"2026-08-07T15:36:06.897941Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.304924Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.304924Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:8dcba62b4d0b228204a12bbca34950d7e49bd45e63c79d33fba6d19977db2ff8","observation_id":"74c62790-e0fe-4152-bc5b-56ac50717ced","resolution":{"observed_at":"2026-08-07T15:36:06.304924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.308588Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.308588Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:eb47c92e9c3ffc09d096e4b2e79138d3797d7fb759409196b1bd77958df8ce6d","observation_id":"4cbca74a-98a1-415f-85ad-e34903769a76","resolution":{"observed_at":"2026-08-07T15:36:06.308588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.312141Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.312141Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:62513d2955641722c1a52f0318aae5d348219e03d20afd9bc88d1403f3d546d7","observation_id":"85696020-767c-4186-ba30-4a7059a76822","resolution":{"observed_at":"2026-08-07T15:36:06.312141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.315624Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.315624Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:a3702602566659ac629e70477c1d115a433f9e051364ae8e336c22362ebd57c0","observation_id":"5668d442-49b1-4bcc-94a6-b89a4d34bfd5","resolution":{"observed_at":"2026-08-07T15:36:06.315624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-10T14:07:02.234322Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T15:36:06.318473Z","title":"Phi-3 technical report: A highly capable language model locally on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.318473Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:322fff0d09595de13a9d6f612a6c259fb893c6e922f77e87954384617aa86e88","observation_id":"21abcae5-f18a-4f40-b107-0720c7b7cd6f","resolution":{"observed_at":"2026-08-07T15:36:06.318473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T15:36:06.321890Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.321890Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:9f87f561035d753b04a4d8e59a1d8787729aae9383dd0f2c54c490901ed85c2b","observation_id":"20a64d52-2935-47af-b9c1-a553aa111a4b","resolution":{"observed_at":"2026-08-07T15:36:06.321890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18058","last_updated":"2024-11-02T11:08:49Z","snapshot_observed_at":"2026-08-13T00:44:22.764087Z","submitted_at":"2024-03-26T19:24:18Z","title":"COIG-CQIA: Quality is All You Need for Chinese Instruction Fine-tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18058","snapshot_observed_at":"2026-08-07T15:36:06.325426Z","title":"Coig-cqia: Quality is all you need for chinese instruction fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.325426Z"},"links":{"cited_paper":"/paper/2403.18058","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:2c4180f18de688dcc4d1a9f21c3398db88fce21d1b4b602042a1b6186761f2ce","observation_id":"09662989-9801-4a1f-a2ad-27e8eee8589a","resolution":{"observed_at":"2026-08-07T15:36:06.325426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02524","last_updated":"2024-02-01T22:06:51Z","snapshot_observed_at":"2026-08-13T04:48:46.975482Z","submitted_at":"2024-01-04T20:23:51Z","title":"Comprehensive Exploration of Synthetic Data Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02524","snapshot_observed_at":"2026-08-07T15:36:06.328740Z","title":"Comprehensive exploration of synthetic data generation: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.328740Z"},"links":{"cited_paper":"/paper/2401.02524","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:d4ca7d4432b75d7e19dc78c888e37496c9be77ac07ea7164f7acc7177b52b8a2","observation_id":"52a9be16-ce12-44b2-adee-e2b3b92fdbcd","resolution":{"observed_at":"2026-08-07T15:36:06.328740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-14T19:47:04.330126Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-07T15:36:06.332583Z","title":"Deepseek llm: Scaling open-source language models with longtermism","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.332583Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:78749aff3a660f43b551a02cf00e84d5928f6ba5b9c87ac3a40dd88cc32d22a3","observation_id":"c5aa4bde-b879-4805-9a29-7d54defcacc7","resolution":{"observed_at":"2026-08-07T15:36:06.332583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.335828Z","title":"On the resemblance and containment of documents","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.335828Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:374cacd474b6b4aba99dda2a90f9876c3fa10e8c46013b6be62d27a48a59e8e1","observation_id":"f90a61bc-80c7-44b3-b79d-3bf89ca6a168","resolution":{"observed_at":"2026-08-07T15:36:06.335828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17126","last_updated":"2024-03-11T01:15:09Z","snapshot_observed_at":"2026-08-13T11:32:12.012132Z","submitted_at":"2023-05-26T17:50:11Z","title":"Large Language Models as Tool Makers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17126","snapshot_observed_at":"2026-08-07T15:36:06.338637Z","title":"Large language models as tool makers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.338637Z"},"links":{"cited_paper":"/paper/2305.17126","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:230754d527c79f9cb93834adb23243e7ef08d1b4c5d24db4fcc9b606334cd5ec","observation_id":"0d88b97c-7e2b-4861-9c60-b23408cca9f8","resolution":{"observed_at":"2026-08-07T15:36:06.338637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04736","last_updated":"2023-10-02T20:56:35Z","snapshot_observed_at":"2026-08-13T12:05:32.604750Z","submitted_at":"2023-04-10T17:47:39Z","title":"On the Possibilities of AI-Generated Text Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04736","snapshot_observed_at":"2026-08-07T15:36:06.342022Z","title":"On the possibilities of ai-generated text detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.342022Z"},"links":{"cited_paper":"/paper/2304.04736","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:c11e052c24df69337723f19d3f2edd0f6f617d875ca53bc628b186b6bfafbe79","observation_id":"afa15b21-dbdf-4136-ba27-ff584da8e596","resolution":{"observed_at":"2026-08-07T15:36:06.342022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12588","snapshot_observed_at":"2026-08-07T15:36:06.345351Z","title":"Program of thoughts prompting: Disentangling computation from reasoning for numerical reasoning tasks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.345351Z"},"links":{"cited_paper":"/paper/2211.12588","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:79754f704023f31a11c8333ea920dbb705237895c3b1cfa35dc689d8a4bbc95f","observation_id":"21b7229e-1fbf-4a27-b830-66a15c5cadb5","resolution":{"observed_at":"2026-08-07T15:36:06.345351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.349742Z","title":"Picle: Eliciting diverse behaviors from large language models with persona in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.349742Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:5168ac0cbd681221cba2cd52dbe96d5d38e0124e50322c003e9437dc1f56553d","observation_id":"1405ed2e-a45e-4470-84b2-701684b1d8bb","resolution":{"observed_at":"2026-08-07T15:36:06.349742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.352562Z","title":"Redpajama: an open dataset for training large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.352562Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:22b84f6423c35a989821666772a3daeb1862f0d6d4d1fdc31d757c3ea5d826c2","observation_id":"5a51461d-e2dd-4efe-b594-ce34873f2643","resolution":{"observed_at":"2026-08-07T15:36:06.352562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10668","last_updated":"2024-03-18T23:15:47Z","snapshot_observed_at":"2026-07-06T16:20:36.866744Z","submitted_at":"2023-09-19T14:50:38Z","title":"Language Modeling Is Compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10668","snapshot_observed_at":"2026-08-07T15:36:06.356177Z","title":"Language modeling is compression","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.356177Z"},"links":{"cited_paper":"/paper/2309.10668","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:de55cf5f00359be21fa091404e102af2ac8341e89a1a9d429e38d5140d3948fc","observation_id":"7413d78d-95e2-4d9f-acd9-2984b93bf6d5","resolution":{"observed_at":"2026-08-07T15:36:06.356177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07043","last_updated":"2024-05-31T12:27:52Z","snapshot_observed_at":"2026-08-13T13:56:36.415766Z","submitted_at":"2024-02-10T21:06:34Z","title":"A Tale of Tails: Model Collapse as a Change of Scaling Laws","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07043","snapshot_observed_at":"2026-08-07T15:36:06.359664Z","title":"A tale of tails: Model collapse as a change of scaling laws","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.359664Z"},"links":{"cited_paper":"/paper/2402.07043","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:71ee75057788f3f369001c36c9e4b0d2190d84a2225f63807eea14f47d422019","observation_id":"2ae4fb71-06e8-49bc-8eca-89de8e887beb","resolution":{"observed_at":"2026-08-07T15:36:06.359664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19165","last_updated":"2023-05-30T16:09:19Z","snapshot_observed_at":"2026-08-13T11:29:18.263671Z","submitted_at":"2023-05-30T16:09:19Z","title":"Strategic Reasoning with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19165","snapshot_observed_at":"2026-08-07T15:36:06.362578Z","title":"Strategic reasoning with language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.362578Z"},"links":{"cited_paper":"/paper/2305.19165","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:839abd218d5706e0564067f88de71ee613f99c9135913df7984ecbccfcb1cc41","observation_id":"4faf4db1-debf-4a2f-8ddc-b2fc06b7122e","resolution":{"observed_at":"2026-08-07T15:36:06.362578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.366714Z","title":"In-context autoencoder for context compression in a large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.366714Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:64cad912fcf42ee2373887b80d0c8b98baa899b0c69961ce3ac597f53f4dde05","observation_id":"d726a659-b00e-4df7-aaf4-a2d1286460d4","resolution":{"observed_at":"2026-08-07T15:36:06.366714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T15:36:06.369829Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.369829Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:37e5d4abd902e7a1923c8b5f6d23f43197acacc3a0d204180035fc32c17a0ac1","observation_id":"b7192de9-1256-4ad8-b904-268727dd568d","resolution":{"observed_at":"2026-08-07T15:36:06.369829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02333","last_updated":"2024-05-08T01:48:46Z","snapshot_observed_at":"2026-08-13T23:11:14.700768Z","submitted_at":"2024-03-04T18:58:30Z","title":"Key-Point-Driven Data Synthesis with its Enhancement on Mathematical Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02333","snapshot_observed_at":"2026-08-07T15:36:06.373531Z","title":"Key-point-driven data synthesis with its enhancement on mathematical reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.373531Z"},"links":{"cited_paper":"/paper/2403.02333","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:5d8efd6ede99d1e11be2e3b5d90b6657166fdbe9648d13f0a0000180f453e8c3","observation_id":"06432e54-e417-44d7-9902-2eb4ccfde470","resolution":{"observed_at":"2026-08-07T15:36:06.373531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10007","last_updated":"2023-12-15T18:23:50Z","snapshot_observed_at":"2026-08-14T09:54:32.260367Z","submitted_at":"2023-12-15T18:23:50Z","title":"Faithful Persona-based Conversational Dataset Generation with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10007","snapshot_observed_at":"2026-08-07T15:36:06.376808Z","title":"Faithful persona-based conversational dataset generation with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.376808Z"},"links":{"cited_paper":"/paper/2312.10007","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:c528107574f4537ad490a714cf626a13bce8fa3188089d021c9d10acac34710d","observation_id":"3b5bc89c-99c8-4400-b84a-031101db309c","resolution":{"observed_at":"2026-08-07T15:36:06.376808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T15:36:06.380190Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.380190Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:7648c7733c03ba389bbbf8d556fd9755dfa5b3354deb06bb74ca758276273b14","observation_id":"ee75c507-c25e-4733-9c31-0d82864e5e88","resolution":{"observed_at":"2026-08-07T15:36:06.380190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04706","last_updated":"2024-03-07T18:00:40Z","snapshot_observed_at":"2026-08-14T22:08:26.131452Z","submitted_at":"2024-03-07T18:00:40Z","title":"Common 7B Language Models Already Possess Strong Math Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04706","snapshot_observed_at":"2026-08-07T15:36:06.383838Z","title":"Common 7b language models already possess strong math capabilities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.383838Z"},"links":{"cited_paper":"/paper/2403.04706","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:28d155a55e5de2f53865e006f048fc832eb387296427c5f028b1d88f4f6d1986","observation_id":"560a043a-ec6b-49b2-a8fe-9d6f48442fb0","resolution":{"observed_at":"2026-08-07T15:36:06.383838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13064","last_updated":"2024-02-20T15:00:35Z","snapshot_observed_at":"2026-08-13T04:14:27.645630Z","submitted_at":"2024-02-20T15:00:35Z","title":"Synthetic Data (Almost) from Scratch: Generalized Instruction Tuning for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13064","snapshot_observed_at":"2026-08-07T15:36:06.387394Z","title":"Synthetic data (almost) from scratch: Generalized instruction tuning for language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.387394Z"},"links":{"cited_paper":"/paper/2402.13064","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:72e493f95595e0766e52bcfbb900235c7bfa38159a58b5dd0ef0abece176accd","observation_id":"0fe56072-f9ae-47de-be6a-3ad2ccabe180","resolution":{"observed_at":"2026-08-07T15:36:06.387394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04978","last_updated":"2024-04-02T18:29:52Z","snapshot_observed_at":"2026-08-13T05:29:36.191577Z","submitted_at":"2023-11-08T19:01:13Z","title":"On the steerability of large language models toward data-driven personas","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04978","snapshot_observed_at":"2026-08-07T15:36:06.391546Z","title":"On the steerability of large language models toward data-driven personas","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.391546Z"},"links":{"cited_paper":"/paper/2311.04978","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:7a0518fa73a9e0ed8162d5d1797ead5b9495802a0569019d6f2158f1d7fe0d5c","observation_id":"1e659dce-8972-4e91-98ea-2f1ccbee1ba5","resolution":{"observed_at":"2026-08-07T15:36:06.391546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-08-07T15:36:06.394612Z","title":"Textbooks are all you need ii: phi-1.5 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.394612Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:84d0de458637c2351989311fbd8003ba445dd90c58d2e1ed00ceb3feb7426829","observation_id":"71e9b821-fd5c-42ee-b616-ab7b1d148288","resolution":{"observed_at":"2026-08-07T15:36:06.394612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07503","last_updated":"2024-08-10T20:46:47Z","snapshot_observed_at":"2026-08-13T00:32:55.965962Z","submitted_at":"2024-04-11T06:34:17Z","title":"Best Practices and Lessons Learned on Synthetic Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07503","snapshot_observed_at":"2026-08-07T15:36:06.398779Z","title":"Best practices and lessons learned on synthetic data for language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.398779Z"},"links":{"cited_paper":"/paper/2404.07503","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:20c4b652117b3e5c3f9410edbdfe93e906458a54ec85cb648b6cde43509c092d","observation_id":"8edad706-d3c8-40b0-8ebf-6afbea63334e","resolution":{"observed_at":"2026-08-07T15:36:06.398779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02170","last_updated":"2024-11-15T04:30:04Z","snapshot_observed_at":"2026-08-07T04:49:42.215176Z","submitted_at":"2023-10-03T16:05:48Z","title":"A Dynamic LLM-Powered Agent Network for Task-Oriented Agent Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02170","snapshot_observed_at":"2026-08-07T15:36:06.402644Z","title":"Dynamic llm-agent network: An llm-agent collaboration framework with agent team optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.402644Z"},"links":{"cited_paper":"/paper/2310.02170","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:98533b0652d4e0159ccb4ac8dac405e6146718704ebf8d2749cc7bc014b692f3","observation_id":"9cf7383f-98b0-4199-9d5c-07e4f4053c91","resolution":{"observed_at":"2026-08-07T15:36:06.402644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16380","last_updated":"2024-01-29T18:19:08Z","snapshot_observed_at":"2026-08-13T04:32:26.957409Z","submitted_at":"2024-01-29T18:19:08Z","title":"Rephrasing the Web: A Recipe for Compute and Data-Efficient Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16380","snapshot_observed_at":"2026-08-07T15:36:06.407101Z","title":"Rephrasing the web: A recipe for compute and data-efficient language modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.407101Z"},"links":{"cited_paper":"/paper/2401.16380","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:813b615a1e8204d5475d342ec7215ead5b852f818bdbb134ed065c65129c19b1","observation_id":"9f419473-e6d6-437e-a476-a105c49ab2c8","resolution":{"observed_at":"2026-08-07T15:36:06.407101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13661","last_updated":"2023-10-26T20:45:39Z","snapshot_observed_at":"2026-08-14T09:31:16.035934Z","submitted_at":"2023-05-23T04:10:26Z","title":"On the Risk of Misinformation Pollution with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13661","snapshot_observed_at":"2026-08-07T15:36:06.410393Z","title":"On the risk of misinformation pollution with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.410393Z"},"links":{"cited_paper":"/paper/2305.13661","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:c9b03438eb05ec1473ad3ffa1cedd7599811674e7581995b5edb0ab4198b0cdd","observation_id":"d04cee5b-e914-4db7-827a-78d179741f41","resolution":{"observed_at":"2026-08-07T15:36:06.410393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.413628Z","title":"Generative agents: Interactive simulacra of human behavior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.413628Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:e8646529acae8b6acf78384055b423a0eddb75c20d3d834fb08202495c7acd34","observation_id":"a14e6e12-d476-42c7-8230-441855efed1c","resolution":{"observed_at":"2026-08-07T15:36:06.413628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.416532Z","title":"Toolformer: Language models can teach themselves to use tools","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.416532Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:4ba2aa22cf49425d8435edcfd13d9bf84683a43525a059e754422ec6bad062f7","observation_id":"1f46e2c8-64e6-4053-893a-9ff517eac8c5","resolution":{"observed_at":"2026-08-07T15:36:06.416532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.420215Z","title":"Role play with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.420215Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:6cd0958c8a53f92ab504f8df0ff26645395165c1d0b8c343e2d4763723a2ca29","observation_id":"fd91a9fb-20eb-4044-91e3-eb6fc23421de","resolution":{"observed_at":"2026-08-07T15:36:06.420215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17493","last_updated":"2024-04-14T05:20:10Z","snapshot_observed_at":"2026-08-05T16:03:40.517679Z","submitted_at":"2023-05-27T15:10:41Z","title":"The Curse of Recursion: Training on Generated Data Makes Models Forget","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17493","snapshot_observed_at":"2026-08-07T15:36:06.423517Z","title":"The curse of recursion: Training on generated data makes models forget","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.423517Z"},"links":{"cited_paper":"/paper/2305.17493","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:bafaf519b254f7bbc1da8c4c20bd9eb881dc704434ea382364d88d875f9011da","observation_id":"0096578c-eaad-445a-a237-1b52dcfc26c4","resolution":{"observed_at":"2026-08-07T15:36:06.423517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:07.500546Z","title":"Introducing qwen1.5, February 2024","venue":null,"work_id":"e10910e1-2bcb-4b23-9356-275e1521649a","year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.427124Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:0bee7dd5a04ab2e3f76da325265a1593cf5fc6569bead1f3859bf0c3fbfd1ccf","observation_id":"6391e0cf-ee5e-4b28-9c9a-685b4e98ca96","resolution":{"observed_at":"2026-08-07T15:36:07.503540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:07.491215Z","title":"An experimental study of the small world problem","venue":null,"work_id":"f119159d-b63e-488f-902a-7474bf56180d","year":1977},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.430052Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:b88e30135741c3b05f35466c905d80fe693a7ba794ad7a9168bbe819706a0c09","observation_id":"f15f7804-c85e-479e-974a-1e584c3f7231","resolution":{"observed_at":"2026-08-07T15:36:07.494829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.433028Z","title":"Position: Will we run out of data? limits of llm scaling based on human-generated data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.433028Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:87da92b8b327e234e032fe132e0a6546fafaf8e74067943125ce2655773f2aba","observation_id":"99162bc3-e811-43b2-9a9d-b354e8315ef5","resolution":{"observed_at":"2026-08-07T15:36:06.433028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03731","last_updated":"2023-10-05T17:52:09Z","snapshot_observed_at":"2026-08-15T04:39:29.717436Z","submitted_at":"2023-10-05T17:52:09Z","title":"MathCoder: Seamless Code Integration in LLMs for Enhanced Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03731","snapshot_observed_at":"2026-08-07T15:36:06.435967Z","title":"Mathcoder: Seamless code integration in llms for enhanced mathematical reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.435967Z"},"links":{"cited_paper":"/paper/2310.03731","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:cec2793fc766b0f044d44eb8a93a624b20f5d5eadf2a480034ec0f9174d9fa4f","observation_id":"9ac6abfd-775f-4358-9e43-fbd191d1ff3e","resolution":{"observed_at":"2026-08-07T15:36:06.435967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-08-13T22:45:34.795769Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-07T15:36:06.439307Z","title":"Self-instruct: Aligning language models with self-generated instructions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.439307Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:626d42dec64de58094d4dfe9827c03f8b3266e55ff8d8aabc10571c16edf4135","observation_id":"9d40511d-7006-4ef1-aa8d-2ef011792d77","resolution":{"observed_at":"2026-08-07T15:36:06.439307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:07.477148Z","title":"Unleashing the emergent cognitive synergy in large language models: A task-solving agent through multi-persona self-collaboration","venue":null,"work_id":"0212cb20-cc2f-46e5-9060-7af0e525c9cb","year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.442693Z"},"links":{"citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:f3f0c52e432ad2172f84602e8a8691fcb18a3bcebfd1e83d9378dfee6dd1906d","observation_id":"4788c87d-1a02-44d3-86ac-ed09f94eb227","resolution":{"observed_at":"2026-08-07T15:36:07.480301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11817","last_updated":"2025-02-13T08:11:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-22T10:26:14Z","title":"Hallucination is Inevitable: An Innate Limitation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11817","snapshot_observed_at":"2026-08-07T15:36:06.445499Z","title":"Hallucination is inevitable: An innate limitation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.445499Z"},"links":{"cited_paper":"/paper/2401.11817","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:34d7fbe78d3f485183e33c5df4dc59adb190e9fdfe454a00ad25031475f404be","observation_id":"21b16f2e-9ee1-4108-a381-27e20d616894","resolution":{"observed_at":"2026-08-07T15:36:06.445499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-07T15:36:06.449701Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training","version":2},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:06.449701Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2505.14681"},"observation_digest":"sha256:9161d077f41e6f29839842fa34c6dc576336e02860f715a565de536ddaf8353b","observation_id":"110233b7-af77-46b2-9ff7-b83af62e853a","resolution":{"observed_at":"2026-08-07T15:36:06.449701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14681","last_updated":"2025-05-27T09:35:12Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T22:01:02.132914Z","submitted_at":"2025-05-20T17:59:16Z","title":"Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":96,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":104},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 100 of 104 outbound references and 2 inbound Pith citation observations for arXiv:2505.14681."}