Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-07T14:40:42.903751Z
Paper Citation Record · LEDGER
As of 7 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 2 inbound Pith citation observations for arXiv:2505.18149.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-07T14:40:42.903751Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links, observed 2026-08-06T17:53:40.869843Z
A source-named dated measurement, never combined with another source.
Source: arxiv_reference, observed 2026-07-02T17:17:15.138349Z
38 of 38 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation ce71aa4e-0dad-4bbc-9b6d-c514e9926bbf · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Phi-4-reasoning Technical Report
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f61a9703-8231-42c3-8f5b-40a9bcd5dedf · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning
Reference 2
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e96f47e2-f43f-4f40-8102-ccc4f2222df1 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Thinking Machines: A Survey of LLM based Reasoning Strategies
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9f62ca1a-5efa-4f2c-b642-eb3c7fba6a69 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Large Language Monkeys: Scaling Inference Compute with Repeated Sampling
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 497ae892-7eae-4ea4-a8f3-64b0ccdbb7ff · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Unresolved cited work
Reference 5
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ee5895d2-ec4b-4382-b62f-9901f05fa8c2 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Galambos
Reference 6
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 098f2393-f22d-45e7-a763-0ae6dba4a78e · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Stream of Search (SoS): Learning to Search in Language
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b3655294-b413-4057-a4ce-ff9bb760fd73 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
Reference 8
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 587aa42e-bd3f-49f0-bb65-5e8e184b92c6 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Unresolved cited work
Reference 9
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 6891f0ac-5f4e-444b-8e7c-e08b7b453a40 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models OlympicArena Medal Ranks: Who Is the Most Intelligent AI So Far?
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d20acd15-cff0-4775-bde4-9c56bb80c01b · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Evolving Deeper LLM Thinking
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 641263f8-c8c2-4378-8ca2-b52cdcc7e3b1 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models A Simple Model of Inference Scaling Laws
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1d51f9f6-71e7-4b35-8641-d17ab126bf7f · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models S*: Test Time Scaling for Code Generation
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8affb4cb-92e0-4b06-b76c-5ca0b89c2d76 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Learning to Reason from Feedback at Test-Time
Reference 14
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a97404e4-6e93-4568-9269-9c9949baf107 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models From System 1 to System 2: A Survey of Reasoning Large Language Models
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bdc76d2d-090b-4bd4-8120-59bd30323835 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models DeepSeek-V3 Technical Report
Reference 16
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 58bc3bbb-01bc-402c-bb0b-67aa8298aa77 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Don't throw away your value model! Generating more preferable text with Value-Guided Monte-Carlo Tree Search decoding
Reference 17
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 11de2ecb-a877-4491-bc81-8436d449d41f · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Aime problems and solutions
Reference 18
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 2371bc63-b9c9-49ea-8395-18021ff9196f · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models s1: Simple test-time scaling
Reference 19
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7cdde967-89a1-4952-af17-1847709248f3 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Learning to reason with llms
Reference 20
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 9469758e-8822-4cb0-b939-79f6c33f487d · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Unresolved cited work
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e8a2ba81-decd-4911-b96e-44adcf724f05 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Agentic Reward Modeling: Integrating Human Preferences with Verifiable Correctness Signals for Reliable Reward Systems
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7987d3da-ce64-422a-9779-f9d097f1d6a5 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Unresolved cited work
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f9deeb4e-e44e-4dc1-b3b1-4aefd34e8f02 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6ce7f65b-9d25-468b-b1fc-5e6a28aaf0e9 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Unresolved cited work
Reference 25
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 03193b64-3997-472f-b58a-fb3fda932b77 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Diverse Beam Search: Decoding Diverse Solutions from Neural Sequence Models
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b3feee3c-4cff-4bec-80d7-48957c93de28 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models MCTS-Judge: Test-Time Scaling in LLM-as-a-Judge for Code Correctness Evaluation
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4fc7de80-569c-4865-9f02-3751b968a9cb · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs
Reference 28
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 07e50bf0-a5c8-4ad7-ade3-bd0e2263271b · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models From Decoding to Meta-Generation: Inference-time Algorithms for Large Language Models
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b7886825-e9f0-4228-9f38-d78df43c4302 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Unresolved cited work
Reference 30
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation aab6bc26-c491-4c70-a393-298260d74354 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Monte Carlo Tree Search Boosts Reasoning via Iterative Preference Learning
Reference 31
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 67a2b27c-f669-4e92-82c5-747935fa7ec6 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Qwen2.5 Technical Report
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c2ef4477-229f-4c36-a4d9-fa1df9c27b32 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Qwen3 Technical Report
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e2f61140-d94d-4675-ba74-4790077aeae0 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Step Back to Leap Forward: Self-Backtracking for Boosting Reasoning of Language Models
Reference 34
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation da283fa3-a8ac-4004-b05a-2ef47b81a6e6 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?
Reference 35
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 78f0f04c-8b72-4920-9d4d-bdc76f798214 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Planning with Large Language Models for Code Generation
Reference 36
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6a0047ff-82ce-4a70-a95c-6fb8b39bc50b · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models So, 22 = 4 does not divide n4 + 1for any n
Reference 37
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 963f95f2-006d-4d81-a5fd-c4291c12c796 · outbound
First Finish Search: Efficient Test-Time Scaling in Large Language Models Find the least positive integermsuch thatm 4 + 1is divisible byp 2
Reference 208
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation fe208371-4307-450f-ae9a-f534c222f62b · inbound
Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey First Finish Search: Efficient Test-Time Scaling in Large Language Models
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7b075402-bc0c-4bf8-9700-afa59a9af154 · inbound
EASE-TTT: Evidence-Aligned Selective Test-Time Training for Long-Context Question Answering First Finish Search: Efficient Test-Time Scaling in Large Language Models
Reference 10
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.