{"as_of":"2026-08-09T01:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4d0e5e9b8d3ea06a945ad41bcd1ed158ebe9588e906358e7d84b879e539d8447","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:46:01.590792Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:12:10.059856Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12759","snapshot_observed_at":"2026-08-04T09:12:10.059856Z","title":"Logit arithmetic elicits long reasoning capabilities without training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.17045","last_updated":"2026-06-01T07:19:41Z","snapshot_observed_at":"2026-08-04T09:12:02.562884Z","submitted_at":"2025-10-19T23:17:13Z","title":"Video Reasoning without Training","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T09:12:10.059856Z"},"links":{"cited_paper":"/paper/2507.12759","citing_paper":"/paper/2510.17045"},"observation_digest":"sha256:2d695078e490eae6b5b1bc571b4d74a87e6188d2725ca7aa69b55283bdc0cce8","observation_id":"3832b309-32bc-404f-8095-26e1c51ab8a8","resolution":{"observed_at":"2026-08-04T09:12:10.059856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12759/citation-record","integrity":"/paper/2507.12759/integrity","json":"/paper/2507.12759/citation-record.json","paper":"/paper/2507.12759"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-06T16:45:56.445386Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.445386Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:4131cf715ad4d273f2f524ec54da432ac952c9c2eebc40cb97742bac2434ff58","observation_id":"21997aab-3d1a-4cb8-b179-e2f83a94a126","resolution":{"observed_at":"2026-08-06T16:45:56.445386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-06T16:45:56.493664Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.493664Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:3014b00e74a699a0ad8f9ba2d5710d201a848fb53f30bb14da6640e87151d844","observation_id":"f6c26582-69dd-4d78-b5a2-713aefe9aad1","resolution":{"observed_at":"2026-08-06T16:45:56.493664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-06T16:45:56.582452Z","title":"Do NOT think that much for 2+3=? on the overthinking of o1-like llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.582452Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:7830817489ba8409ecb6fce100c126853bfed245b8cedf9d48e033b87e775050","observation_id":"12c0f1fe-df2f-42d6-a4e0-8ffaec5705d1","resolution":{"observed_at":"2026-08-06T16:45:56.582452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:04.194669Z","title":"Glass, and Pengcheng He","venue":null,"work_id":"f6c9c419-5f52-4d8e-9e65-a0255bb3b295","year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.671514Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:07814405945d89cf1e49f4e9179f512cf8a62c0ea898a7c79723a7178fa0254f","observation_id":"de9cfe34-37b3-43fc-ab64-454abe207e69","resolution":{"observed_at":"2026-08-06T16:46:04.279684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T16:45:56.752932Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.752932Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:3da0b9151c408b20aa2a089fdb822b105819e23bee7859f641419de6f4bd4248","observation_id":"a9939c19-8436-4e7b-b368-9e44db16b45e","resolution":{"observed_at":"2026-08-06T16:45:56.752932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:56.817307Z","title":"Reinforcement learning for reasoning in small llms: What works and what doesn't","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.817307Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:987ac01723413902264406fbb3b3e2216c755f59e594884fd7bf00dad7b77312","observation_id":"2c64b3b2-1519-44f8-8d23-cfdb3e01f7ff","resolution":{"observed_at":"2026-08-06T16:45:56.817307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T16:45:56.908594Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.908594Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:e3a8311d547dcaa2c5f948760c11e63353871715c27ec92af840f60779b80b63","observation_id":"683c4a71-7ef6-48e9-b07e-7feec6730d36","resolution":{"observed_at":"2026-08-06T16:45:56.908594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:04.066432Z","title":"On giant's shoulders: Effortless weak to strong by dynamic logits fusion","venue":null,"work_id":"3c30cf13-aff9-4c5d-9ea2-bccdded1f63a","year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.978033Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:561a659c67a8b08025c8e2f0e9111fd8e37cee9d27160797c17a2caabdc60ff5","observation_id":"8f246712-f3af-47f5-9297-06a5801a5a63","resolution":{"observed_at":"2026-08-06T16:46:04.110157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.964222Z","title":"On giant's shoulders: Effortless weak to strong by dynamic logits fusion","venue":null,"work_id":"d32de0ec-d2b3-4fa9-8b7e-113ff0944cba","year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.091755Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:8cb899fa97c2a145c08787845d20853580db488c376ec75d3a268ad9cfddda28","observation_id":"72107da5-6899-40ae-b762-4edcbbd86c67","resolution":{"observed_at":"2026-08-06T16:46:04.001284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01307","last_updated":"2025-08-15T15:21:46Z","snapshot_observed_at":"2026-08-08T21:52:29.510852Z","submitted_at":"2025-03-03T08:46:22Z","title":"Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01307","snapshot_observed_at":"2026-08-06T16:45:57.160987Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.160987Z"},"links":{"cited_paper":"/paper/2503.01307","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:5834d66ebd9f07f3083d4921f5711615df74e9c66488877751f6fb88e9e31b31","observation_id":"70215125-4178-4489-98dd-6b7077763c63","resolution":{"observed_at":"2026-08-06T16:45:57.160987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:57.244757Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.244757Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:cf04b99a80170d4c0fdcfbe858589544db666dcf82af50093f5ee2cc34cb23fc","observation_id":"9b39ac8c-3f01-4e6e-a3fb-269e31ca2629","resolution":{"observed_at":"2026-08-06T16:45:57.244757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06457","last_updated":"2024-08-14T02:41:48Z","snapshot_observed_at":"2026-07-06T17:28:02.037844Z","submitted_at":"2024-02-09T15:02:56Z","title":"V-STaR: Training Verifiers for Self-Taught Reasoners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06457","snapshot_observed_at":"2026-08-06T16:45:57.308861Z","title":"Courville, Alessandro Sordoni, and Rishabh Agarwal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.308861Z"},"links":{"cited_paper":"/paper/2402.06457","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:af0d7feb0a822b5526796b4dc0a7c223404b003b78bcad1d51ba352e32defbd6","observation_id":"f2f772cb-6146-4cc0-9396-c32185c08b19","resolution":{"observed_at":"2026-08-06T16:45:57.308861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:57.397518Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen - Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.397518Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:cd90f3e844e337eb5a6d690880ec2f825512274965691df423ab483e42a7de9e","observation_id":"02eb302f-a275-47bb-a55e-eeeb33530590","resolution":{"observed_at":"2026-08-06T16:45:57.397518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.801123Z","title":"Huang, Wenxuan Zhou, Fei Wang, Fred Morstatter, Sheng Zhang, Hoifung Poon, and Muhao Chen","venue":null,"work_id":"bf1e088c-08a4-41f2-842b-1a22d6727468","year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.492658Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:34f13fab4db3697368096b16c622b30aac69e880fea49cacf574c5b96020ada6","observation_id":"0573bae5-1f12-4cf5-bfb5-eb62573307aa","resolution":{"observed_at":"2026-08-06T16:46:03.887735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.1022","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:02.165694Z","title":"GRACE: discriminator-guided chain-of-thought reasoning","venue":null,"work_id":"7aef63c3-3c4d-4676-a552-6f6b80b06837","year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.588142Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:7a7f66bec360947ea7ba80ab65a96ff15e10178cff487408ef55f8f1c1ce2c19","observation_id":"6df1b769-c361-48cb-89dc-a0ddd3936064","resolution":{"observed_at":"2026-08-06T16:46:02.242062Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2504.16828","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:02.025489Z","title":"Process reward models that think","venue":null,"work_id":"3ceb0c3b-4e0c-43b8-96fc-2d45118afee7","year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.681278Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:d91c17f877bdbdbb50c2da4c0c22f04d5fae165991f27bddff02100bee6a481f","observation_id":"3621be0a-5760-4cd0-acf6-9e790bf65ca4","resolution":{"observed_at":"2026-08-06T16:46:02.097358Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-08T12:58:42.430328Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-06T16:45:57.751295Z","title":"Miranda, Alisa Liu, Nouha Dziri, Shane Lyu, Yuling Gu, Saumya Malik, Victoria Graf, Jena D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.751295Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:fc2baa16e6dc52dabcacf61fc58ab5d7a169f16cbfe7b4f3152f6b08a5ca69a2","observation_id":"3cf58925-69cf-438d-894e-8ad8100b90dc","resolution":{"observed_at":"2026-08-06T16:45:57.751295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.683401Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":"9b8ec0a7-6e03-4669-a131-09bd0fc640c0","year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.833649Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:0989f8c5bffbf110efc2d7745c50763f690ac46d2c780aeebed078d4b9a66b2b","observation_id":"30810393-db81-491d-b1e5-367ac46a5321","resolution":{"observed_at":"2026-08-06T16:46:03.730256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07374","last_updated":"2025-02-18T05:20:33Z","snapshot_observed_at":"2026-08-08T12:55:09.579243Z","submitted_at":"2025-02-11T08:48:48Z","title":"LLMs Can Easily Learn to Reason from Demonstrations Structure, not content, is what matters!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07374","snapshot_observed_at":"2026-08-06T16:45:57.928076Z","title":"Patil, Matei Zaharia, Joseph E","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.928076Z"},"links":{"cited_paper":"/paper/2502.07374","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:8e97979ec4dfc87b1d56a0fe9a5a61c38f6fd51bb76b38cd8031eda3ddd80884","observation_id":"a2c1abac-b546-4a5d-91d8-a572085d039e","resolution":{"observed_at":"2026-08-06T16:45:57.928076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:58.052123Z","title":"Contrastive decoding: Open-ended text generation as optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.052123Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:26a3aaa0cd79f3203b805ac00a7618c4fa3b2dacde4433a61a8a1cc5d781a027","observation_id":"9b47a880-1dc7-4fec-a121-dbaa9425df30","resolution":{"observed_at":"2026-08-06T16:45:58.052123Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19324","last_updated":"2025-06-26T03:14:46Z","snapshot_observed_at":"2026-07-06T20:29:07.258163Z","submitted_at":"2025-01-31T17:19:57Z","title":"Reward-Guided Speculative Decoding for Efficient LLM Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19324","snapshot_observed_at":"2026-08-06T16:45:58.173827Z","title":"Reward-guided speculative decoding for efficient LLM reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.173827Z"},"links":{"cited_paper":"/paper/2501.19324","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:c46606be859355e3851e8f814ef80c87e5017f29b613b3e89a9f21dab0a93c1d","observation_id":"c7e65240-89f6-420b-8825-cc760c589dcf","resolution":{"observed_at":"2026-08-06T16:45:58.173827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:58.268945Z","title":"Let's verify step by step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.268945Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:854016eaf4f54b1f43ffc522da8120698a4bc31dee66bf073a7955b0d7daf0eb","observation_id":"b3105c22-e2b1-4ff2-92fc-b78830b46e74","resolution":{"observed_at":"2026-08-06T16:45:58.268945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:58.360990Z","title":"Smith, and Yejin Choi","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.360990Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:c32cc3ae02a8d9ff0a6b38ffe9185133772ecc0646dde30da4db394737c8a7ab","observation_id":"f5267fe8-49f1-4b47-b047-d02ad14612b3","resolution":{"observed_at":"2026-08-06T16:45:58.360990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08565","last_updated":"2024-08-23T05:21:44Z","snapshot_observed_at":"2026-07-06T17:16:17.240820Z","submitted_at":"2024-01-16T18:49:55Z","title":"Tuning Language Models by Proxy","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08565","snapshot_observed_at":"2026-08-06T16:45:58.459933Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.459933Z"},"links":{"cited_paper":"/paper/2401.08565","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:b8cadef2ab32f1626501bd2511a76144c86de489a3f15e9cb9a2837eecdaccd4","observation_id":"48185574-370d-49dd-8c9f-6ea8dab5867c","resolution":{"observed_at":"2026-08-06T16:45:58.459933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-06T16:45:58.575606Z","title":"Understanding r1-zero-like training: A critical perspective","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.575606Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:b6dc4aab0a21b2496e771c2b3e1d99f07597ac6ae7b23d510b115c8e53d040be","observation_id":"d1c89f52-4375-4116-8259-c195484abd60","resolution":{"observed_at":"2026-08-06T16:45:58.575606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.560709Z","title":"Tang, Manan Roongta, Colin Cai, Jeffrey Luo, Li Erran Li, Raluca Ada Popa, and Ion Stoica","venue":null,"work_id":"3f4e0835-5c5f-45d3-ac61-da01cbfc704b","year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.670703Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:42dcf5eaa09821bfebe6faec029196f9df7014eaba0ce39c75a91225c0dd826d","observation_id":"de81d482-37a6-48e5-a4fc-1cd76d878270","resolution":{"observed_at":"2026-08-06T16:46:03.615685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.455942Z","title":null,"venue":null,"work_id":"48ba967c-1c97-4482-bdfe-3f92789a43b9","year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.747530Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:8ede32544d46b8e5793acbb2e7cef5da2dffe285ac03bf3bd62c698c5402aae2","observation_id":"6cfea145-9d9b-4e0e-807a-7a4f0c3969ac","resolution":{"observed_at":"2026-08-06T16:46:03.498018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-06T16:45:58.836736Z","title":"Cand \\` e s, and Tatsunori Hashimoto","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.836736Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:9479e6f042f17cdb7d55d20e8ca3ca3867da5575cd56213bec06a68c0fa11faf","observation_id":"4e47f8da-12a8-42af-b74d-bf6a60355d36","resolution":{"observed_at":"2026-08-06T16:45:58.836736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.342437Z","title":"Learning to reason with LLMs , September 2024","venue":null,"work_id":"04d3df09-5a1f-4d2a-a04e-5f713b2c198d","year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.904810Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:c2378afcc7d61fd2e5bb4464d34961184018458268d1377bf95714b0dab02a79","observation_id":"08f789f8-0a12-4fc8-b284-41784ef7ce7c","resolution":{"observed_at":"2026-08-06T16:46:03.388308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.200710Z","title":"OpenAI o3 and o4-mini System Card","venue":null,"work_id":"1cc7efab-57b0-4c8c-b5e4-5adc3bc645fb","year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.004718Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:f07fa60e3eecfc1fcadbc87478e7dd8f4f37c148d3a2a8ee2f1c93869f907185","observation_id":"a6b54b39-9210-4384-ac66-08f1b3aa6d00","resolution":{"observed_at":"2026-08-06T16:46:03.272016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.180","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:01.773350Z","title":"Comblm: Adapting black-box language models through small fine-tuned models","venue":null,"work_id":"45d5fca0-4f60-491d-a60d-96fa13c0208c","year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.088869Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:41b6e7560197c24ad68fb3e98c3dffd54642f74bd735da08c1b28b016b53b806","observation_id":"4c76ae28-7628-4c96-a283-74aff655653e","resolution":{"observed_at":"2026-08-06T16:46:01.825336Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.071364Z","title":"Qwen3: Think Deeper, Act Faster | Qwen , April 2025","venue":null,"work_id":"817cbc06-4994-4acf-b4fa-d6dd984814d4","year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.154950Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:68bc984a499d6b18c193785f92e98750e0ed16ed75927539ce8bd4e4498e5209","observation_id":"840be525-fc0a-4339-8be2-f5cfaa0a7ec1","resolution":{"observed_at":"2026-08-06T16:46:03.125136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:59.275958Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.275958Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:8e822d4b3c40daad55c223f318116de57a18eec9e23baa13b46c4f9c3c7f3964","observation_id":"310ce96a-aba3-4598-a222-1e967718ed69","resolution":{"observed_at":"2026-08-06T16:45:59.275958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T16:45:59.339469Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.339469Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:4df6c1a7e7770d6e1798b420505c46a7f426580b8e2aaf0fad319b1758512d06","observation_id":"3b16074f-bd1c-418b-9eb6-a96d2e40d9a3","resolution":{"observed_at":"2026-08-06T16:45:59.339469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:59.448540Z","title":"Trusting your evidence: Hallucinate less with context-aware decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.448540Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:b3a289bbd99fc21a48251986f03faa029734e163642555ae12402ae11f408ed3","observation_id":"f117e112-6122-43f6-a1cb-58c24846e449","resolution":{"observed_at":"2026-08-06T16:45:59.448540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-06T16:45:59.557416Z","title":"Scaling LLM test-time compute optimally can be more effective than scaling model parameters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.557416Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:289b5fcfb9b2f89e707962668234d82035b368928f1795d5d68242e199ad71da","observation_id":"86ee16f0-2eb0-4833-9c2c-61f33e7445a3","resolution":{"observed_at":"2026-08-06T16:45:59.557416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11314","last_updated":"2025-06-11T03:55:09Z","snapshot_observed_at":"2026-08-07T17:04:15.538727Z","submitted_at":"2025-03-14T11:30:37Z","title":"Unlocking General Long Chain-of-Thought Reasoning Capabilities of Large Language Models via Representation Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11314","snapshot_observed_at":"2026-08-06T16:45:59.645017Z","title":"Unlocking general long chain-of-thought reasoning capabilities of large language models via representation engineering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.645017Z"},"links":{"cited_paper":"/paper/2503.11314","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:a471f21344e2ceedb77a7c23b91187bd35ac36e94f9e93841e9079f5f5e1b4ca","observation_id":"52fc4979-7cf7-4065-99ee-5faba847a214","resolution":{"observed_at":"2026-08-06T16:45:59.645017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:59.731670Z","title":"Qwq-32b: Embracing the power of reinforcement learning, March 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.731670Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:a43301c75ea81119b72edd9515201f37a81b1897ba23d17e74abe9b26edd9b43","observation_id":"dab5bc7a-86df-4001-a0f0-1f33cda3ed40","resolution":{"observed_at":"2026-08-06T16:45:59.731670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:59.800747Z","title":"Gram: A generative foundation reward model for reward generalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.800747Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:a9da3db817f6943b0396735da1be84cf3668d0d1e0fabdbdaf7da367dbe0b693","observation_id":"7a204399-44e7-4aee-bac5-befa0570377e","resolution":{"observed_at":"2026-08-06T16:45:59.800747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:59.879033Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.879033Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:46357cbb31a52b434e35184555341d3eb82e299d3c4d609b63cbd4935293babe","observation_id":"4d807b13-d1dd-4180-8de4-03d264afaa1a","resolution":{"observed_at":"2026-08-06T16:45:59.879033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:02.923031Z","title":"Chain-of-thought reasoning without prompting","venue":null,"work_id":"8bd3262b-c6ff-4466-8906-c9a54ff3b29c","year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.973845Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:57fbabd1932f8a898f143b01a98232ec81824801752e1a6dd6268bb62e37449e","observation_id":"0a44f2d9-2071-4928-8e47-1f899fa880d6","resolution":{"observed_at":"2026-08-06T16:46:02.991227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:02.800659Z","title":"Le, Ed H","venue":null,"work_id":"f9d19dfa-2fde-4491-8fd1-bb73b36a0624","year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.066822Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:de88a57171e76021586d7a9672570324dd0db50e8158a1d9c67097ab23fe7a22","observation_id":"5feaae47-f273-4fef-a58b-f96b94a4dbb5","resolution":{"observed_at":"2026-08-06T16:46:02.845097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20571","last_updated":"2025-10-24T10:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-29T09:24:30Z","title":"Reinforcement Learning for Reasoning in Large Language Models with One Training Example","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20571","snapshot_observed_at":"2026-08-06T16:46:00.145099Z","title":"Reinforcement learning for reasoning in large language models with one training example","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.145099Z"},"links":{"cited_paper":"/paper/2504.20571","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:9523f34cb25eb6dc4f40e81b9741371e996346417d1456003a873f5e6779494c","observation_id":"2516df83-9dad-4a49-b11f-032b8b455817","resolution":{"observed_at":"2026-08-06T16:46:00.145099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:00.198876Z","title":"Chi, Quoc V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.198876Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:9304eda05c518425a88eb5c4d41c2d57c85350aff08bd990d05a0d92bf72c122","observation_id":"2528988e-4912-4c24-8b27-f7042a856eb2","resolution":{"observed_at":"2026-08-06T16:46:00.198876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:02.670871Z","title":"Self-evaluation guided beam search for reasoning","venue":null,"work_id":"d0a7edcf-1ce3-4ece-8f9e-85beb18228d1","year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.278181Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:5a1bb007defa7236c3eec13eec2cbda20f57061b88f766eea7bacce4116fa41c","observation_id":"7e621c17-b2d2-44fd-866a-9e7f7dd2ef07","resolution":{"observed_at":"2026-08-06T16:46:02.724881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11284","last_updated":"2025-01-20T05:44:01Z","snapshot_observed_at":"2026-08-06T13:30:45.600197Z","submitted_at":"2025-01-20T05:44:01Z","title":"RedStar: Does Scaling Long-CoT Data Unlock Better Slow-Reasoning Systems?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11284","snapshot_observed_at":"2026-08-06T16:46:00.345444Z","title":"Redstar: Does scaling long-cot data unlock better slow-reasoning systems? CoRR, abs/2501.11284, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.345444Z"},"links":{"cited_paper":"/paper/2501.11284","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:f5b8ecf97e8d763b1ef0b5f036ab8cdd241c66da9bbdef3c1fb9d3c554441030","observation_id":"b8cd5682-e691-4445-a0c9-5039ab6d027c","resolution":{"observed_at":"2026-08-06T16:46:00.345444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T16:46:00.453742Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.453742Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:0687bd89c0c2d3d7ff9adecbf0b6db7c7df42d5180c731f54a7619cc0d7d90ac","observation_id":"1a7c90e7-3566-4dcf-b080-56aefd0a6be4","resolution":{"observed_at":"2026-08-06T16:46:00.453742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-06T16:46:00.536206Z","title":"Qwen2.5-math technical report: Toward mathematical expert model via self-improvement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.536206Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:fe061ab50653970a6bbfa23adb3728706bf8308880f7fdc671fde5d12ecffdd8","observation_id":"5f69db3d-332f-4eee-8f94-050a76d6dc61","resolution":{"observed_at":"2026-08-06T16:46:00.536206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12329","last_updated":"2026-06-02T22:05:11Z","snapshot_observed_at":"2026-08-08T01:16:34.338605Z","submitted_at":"2025-04-12T21:25:32Z","title":"Speculative Thinking: Enhancing Small-Model Reasoning with Large Model Guidance at Inference Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12329","snapshot_observed_at":"2026-08-06T16:46:00.618572Z","title":"Speculative thinking: Enhancing small-model reasoning with large model guidance at inference time","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.618572Z"},"links":{"cited_paper":"/paper/2504.12329","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:1bca497c8bb3386ab0b5e2813b063d17e1d52d5dd5284bd6865869dc58ba009b","observation_id":"7d94f4e8-e7dc-4d79-a4e4-9fb7ed4b21c4","resolution":{"observed_at":"2026-08-06T16:46:00.618572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-06T16:46:00.686246Z","title":"LIMO: less is more for reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.686246Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:6531120d661278831c73e5e5c4cf2eb52f0e4487e79ac20591e629691950cfc5","observation_id":"1d121914-4e0e-4a78-b5b5-dce25e4aa682","resolution":{"observed_at":"2026-08-06T16:46:00.686246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T16:46:00.730849Z","title":"DAPO: an open-source LLM reinforcement learning system at scale","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.730849Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:2af5689105ca3bf982b74db44d0134a085325cfcaf605b35f1b5accf14e6224f","observation_id":"b8b882c6-825e-46c9-b0d5-87a17175121c","resolution":{"observed_at":"2026-08-06T16:46:00.730849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13837","last_updated":"2025-11-24T06:11:04Z","snapshot_observed_at":"2026-07-06T21:11:34.701779Z","submitted_at":"2025-04-18T17:59:56Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13837","snapshot_observed_at":"2026-08-06T16:46:00.822409Z","title":"Does reinforcement learning really incentivize reasoning capacity in llms beyond the base model? arXiv preprint arXiv:2504.13837, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.822409Z"},"links":{"cited_paper":"/paper/2504.13837","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:9e93dafa5d90dd1cb3d0c838026074dc42ce2babc0fdb8e9dedee8db978d170f","observation_id":"dc8ecd4c-f1e4-4f32-823c-db3c9e3cf9c6","resolution":{"observed_at":"2026-08-06T16:46:00.822409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13837","last_updated":"2025-11-24T06:11:04Z","snapshot_observed_at":"2026-07-06T21:11:34.701779Z","submitted_at":"2025-04-18T17:59:56Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13837","snapshot_observed_at":"2026-08-06T16:46:00.912514Z","title":"Does reinforcement learning really incentivize reasoning capacity in llms beyond the base model? CoRR, abs/2504.13837, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.912514Z"},"links":{"cited_paper":"/paper/2504.13837","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:f58684a7895089f6d2389e90a362d107c2c5c46825331bbc132a713b3e035c77","observation_id":"4b1d8fbd-71c1-478d-9eeb-d4041f9c5445","resolution":{"observed_at":"2026-08-06T16:46:00.912514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:02.550753Z","title":"Generative verifiers: Reward modeling as next-token prediction","venue":null,"work_id":"b16dc597-ed04-4ca8-90aa-d2b51e9aac08","year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.984525Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:b81e294791cab4448274074ff4d9eec3830bae55548f213a6e86da64f512f5b5","observation_id":"4f63ac81-53f5-45a3-b5dd-0df1df80a4c0","resolution":{"observed_at":"2026-08-06T16:46:02.603535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:01.063828Z","title":"Small language models need strong verifiers to self-correct reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.063828Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:798b2599aaa5248ad0a12f537819c4333d8aeba3d5d9aef713845ef2527bf71d","observation_id":"db22c645-3a9d-4449-ae2f-e80f46d7454a","resolution":{"observed_at":"2026-08-06T16:46:01.063828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17256","last_updated":"2025-07-23T18:43:18Z","snapshot_observed_at":"2026-07-06T17:22:41.286422Z","submitted_at":"2024-01-30T18:48:37Z","title":"Weak-to-Strong Jailbreaking on Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17256","snapshot_observed_at":"2026-08-06T16:46:01.155732Z","title":"Weak-to-strong jailbreaking on large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.155732Z"},"links":{"cited_paper":"/paper/2401.17256","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:cd50e6616585bf6119272c9fcff8ad7c464f28541eed2e07628942aa64c04262","observation_id":"2687ee65-1b68-46c1-91c9-905b049d5d40","resolution":{"observed_at":"2026-08-06T16:46:01.155732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17697","snapshot_observed_at":"2026-08-06T16:46:01.206824Z","title":"Activation control for efficiently eliciting long chain-of-thought ability of language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.206824Z"},"links":{"cited_paper":"/paper/2505.17697","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:041075e8024b85c086018ad72ef23b4d28b0dadd807952036b56a5d2ce9a5d98","observation_id":"35d16542-ddcf-4da5-ab10-74fa647dbe5e","resolution":{"observed_at":"2026-08-06T16:46:01.206824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-06T16:46:01.298001Z","title":"Byun, Zifan Wang, Alex Mallen, Steven Basart, Sanmi Koyejo, Dawn Song, Matt Fredrikson, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.298001Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:2c00fed856297bbe0b80ff83b4ecc8677b5a2296cb092795d3329bf72522ceab","observation_id":"8a7f6206-36ff-4e1b-905e-4c83ef8e8ff2","resolution":{"observed_at":"2026-08-06T16:46:01.298001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:01.378453Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.378453Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:588a51d67f2f9ee79a4d7abb9cc22aeb25831e9155f0dec954e450d712126722","observation_id":"a1851c04-4c34-4986-ba23-3b96d3de57a1","resolution":{"observed_at":"2026-08-06T16:46:01.378453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:01.466254Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.466254Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:87c21ba8f5d7ac169cb166a52f212d0c2cc5847cb52e5af84ab00c3bce2012fe","observation_id":"dde975b2-07f5-4502-ab2f-bc6bc3920c34","resolution":{"observed_at":"2026-08-06T16:46:01.466254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:01.530230Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.530230Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:4ca0bd51c7900aea451fece561e42cd0dc9bc1e110732328eb697c812454553c","observation_id":"ae5ffced-7fb6-493b-ab02-3f51676a415a","resolution":{"observed_at":"2026-08-06T16:46:01.530230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:01.590792Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.590792Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:31de8c338f25566c5e74bbda2f820f5bd9414cf51b6b882e44ef0a9811eb9d13","observation_id":"c720fe2c-13ba-4858-bcc3-25f0e614f163","resolution":{"observed_at":"2026-08-06T16:46:01.590792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":3,"verified_fuzzy":13},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 1 inbound Pith citation observation for arXiv:2507.12759."}