Pith. sign in

Paper Citation Record · LEDGER

First Finish Search: Efficient Test-Time Scaling in Large Language Models

As of 7 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 2 inbound Pith citation observations for arXiv:2505.18149.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.18149 v1

Coverage vector

measured 38 of 38 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:40:42.903751Z

measured 40 of 40 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-06T17:53:40.869843Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-02T17:17:15.138349Z

Reference resolution

38 of 38 outbound references displayed

  • verified exact1
  • verified fuzzy3
  • unresolved33
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation ce71aa4e-0dad-4bbc-9b6d-c514e9926bbf · outbound

This paper cites Phi-4-reasoning Technical Report.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Phi-4-reasoning Technical Report

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:39.958576Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:39.958576Z digest=sha256:647fa47c71c85651f15703b7820f922f1079c91050d43d49df0218b9fbe21224

Observation f61a9703-8231-42c3-8f5b-40a9bcd5dedf · outbound

This paper cites L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning.

First Finish Search: Efficient Test-Time Scaling in Large Language Models L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:39.995140Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:39.995140Z digest=sha256:b725ccace749ebe0a6e4883b26dad3556f019b60154caf397e7c06261aac543b

Observation e96f47e2-f43f-4f40-8102-ccc4f2222df1 · outbound

This paper cites Thinking Machines: A Survey of LLM based Reasoning Strategies.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Thinking Machines: A Survey of LLM based Reasoning Strategies

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:40.111091Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:40.111091Z digest=sha256:c59cb0953b173d912a8a75f3eb646a10ec01b36d77cb7697f786e41b6152695d

Observation 9f62ca1a-5efa-4f2c-b642-eb3c7fba6a69 · outbound

This paper cites Large Language Monkeys: Scaling Inference Compute with Repeated Sampling.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Large Language Monkeys: Scaling Inference Compute with Repeated Sampling

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:40.208024Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:40.208024Z digest=sha256:833b5ba09208c6d3584150d74c87b05c61871abbe48aa8a75f6b5fd017eae202

Observation 497ae892-7eae-4ea4-a8f3-64b0ccdbb7ff · outbound

This paper cites an unresolved cited work.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Unresolved cited work

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:40.297180Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:40.297180Z digest=sha256:123694573079a735f9c2ef0d9912e06cb09b3f53f7a915d33af1686764e54001

Observation ee5895d2-ec4b-4382-b62f-9901f05fa8c2 · outbound

This paper cites Galambos.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Galambos

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:40:44.548698Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:40:40.390665Z digest=sha256:03d7ac6a2e558f7e649ca5fd1e7e2280aea0116c9c8e23f0d8363bec5f3fa7bf

Observation 098f2393-f22d-45e7-a763-0ae6dba4a78e · outbound

This paper cites Stream of Search (SoS): Learning to Search in Language.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Stream of Search (SoS): Learning to Search in Language

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:40.464981Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:40.464981Z digest=sha256:67935c6fc2f240f0638ea5d7588792ba871f8920fcf9e752d9f4f899ff28ee31

Observation b3655294-b413-4057-a4ce-ff9bb760fd73 · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

First Finish Search: Efficient Test-Time Scaling in Large Language Models DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:40.583421Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:40.583421Z digest=sha256:006f6a2a6a2a24e768b5cd39384824ed461061f74aa3c0cdea6922f85c216bd7

Observation 587aa42e-bd3f-49f0-bb65-5e8e184b92c6 · outbound

This paper cites an unresolved cited work.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:40:44.394401Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:40:40.657963Z digest=sha256:bb31252b20d6337b36e94b68f6a976f55908fc434535c2bd4abefbb840572301

Observation 6891f0ac-5f4e-444b-8e7c-e08b7b453a40 · outbound

This paper cites OlympicArena Medal Ranks: Who Is the Most Intelligent AI So Far?.

First Finish Search: Efficient Test-Time Scaling in Large Language Models OlympicArena Medal Ranks: Who Is the Most Intelligent AI So Far?

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:40.764182Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:40.764182Z digest=sha256:e77551b043af83144cb7ad5cb89b80cfaf531e91a8865276ecc8f408a7c437da

Observation d20acd15-cff0-4775-bde4-9c56bb80c01b · outbound

This paper cites Evolving Deeper LLM Thinking.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Evolving Deeper LLM Thinking

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:40.871189Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:40.871189Z digest=sha256:209a702c9847c6614582a2e214aed4fcf1c5b86d146a17acf2cee705a3fe2260

Observation 641263f8-c8c2-4378-8ca2-b52cdcc7e3b1 · outbound

This paper cites A Simple Model of Inference Scaling Laws.

First Finish Search: Efficient Test-Time Scaling in Large Language Models A Simple Model of Inference Scaling Laws

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:40.957595Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:40.957595Z digest=sha256:668b3059f3c62689b3d90d57cfb09f41f0bda8b21e44cf2765f8f0a577a56990

Observation 1d51f9f6-71e7-4b35-8641-d17ab126bf7f · outbound

This paper cites S*: Test Time Scaling for Code Generation.

First Finish Search: Efficient Test-Time Scaling in Large Language Models S*: Test Time Scaling for Code Generation

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:41.058314Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:41.058314Z digest=sha256:62f2bc21cf1c701acd12ec7b0511c40a0c7ac54806f60e1acaed6b4618a50f01

Observation 8affb4cb-92e0-4b06-b76c-5ca0b89c2d76 · outbound

This paper cites Learning to Reason from Feedback at Test-Time.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Learning to Reason from Feedback at Test-Time

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:41.165894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:41.165894Z digest=sha256:a9e60fa2728ea9d5e6f03f4c5b859148231c28808aa73f840e823dbd0e593d20

Observation a97404e4-6e93-4568-9269-9c9949baf107 · outbound

This paper cites From System 1 to System 2: A Survey of Reasoning Large Language Models.

First Finish Search: Efficient Test-Time Scaling in Large Language Models From System 1 to System 2: A Survey of Reasoning Large Language Models

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:41.276077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:41.276077Z digest=sha256:6ef1b3042c36ddaa679c47666818d3a4cbc7eacb31d96c3b5c6a35c26aad8b86

Observation bdc76d2d-090b-4bd4-8120-59bd30323835 · outbound

This paper cites DeepSeek-V3 Technical Report.

First Finish Search: Efficient Test-Time Scaling in Large Language Models DeepSeek-V3 Technical Report

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:41.381868Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:41.381868Z digest=sha256:211431897675153da4653f45b8a4059989eebd6283c39ad10454aff35e57a408

Observation 58bc3bbb-01bc-402c-bb0b-67aa8298aa77 · outbound

This paper cites Don't throw away your value model! Generating more preferable text with Value-Guided Monte-Carlo Tree Search decoding.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Don't throw away your value model! Generating more preferable text with Value-Guided Monte-Carlo Tree Search decoding

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:41.468076Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:41.468076Z digest=sha256:01900561697f0674c0eaa6ee62ac4d1dc24bebfb66df150e615812f8dab8c3a8

Observation 11de2ecb-a877-4491-bc81-8436d449d41f · outbound

This paper cites Aime problems and solutions.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Aime problems and solutions

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:40:44.282250Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:40:41.544855Z digest=sha256:cfaacc6c0e6be7fa4cd478b0ebe28620ada55f9d0bd66851b4150c6eec04e476

Observation 2371bc63-b9c9-49ea-8395-18021ff9196f · outbound

This paper cites s1: Simple test-time scaling.

First Finish Search: Efficient Test-Time Scaling in Large Language Models s1: Simple test-time scaling

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:41.629981Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:41.629981Z digest=sha256:9afc4b0069a43ba8811e4375db8e7592306a4807929ae56af69a132e38513dea

Observation 7cdde967-89a1-4952-af17-1847709248f3 · outbound

This paper cites Learning to reason with llms.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Learning to reason with llms

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:40:44.139462Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:40:41.696588Z digest=sha256:2ecc51bbc6b0df2edcba40f0740eb83479c7ffdaf4f901080d1fce30717b8fcd

Observation 9469758e-8822-4cb0-b939-79f6c33f487d · outbound

This paper cites an unresolved cited work.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Unresolved cited work

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:41.789857Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:41.789857Z digest=sha256:673416deb94b35e905707761f332911962b69a1330195984a4ce409d7ad5b18b

Observation e8a2ba81-decd-4911-b96e-44adcf724f05 · outbound

This paper cites Agentic Reward Modeling: Integrating Human Preferences with Verifiable Correctness Signals for Reliable Reward Systems.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Agentic Reward Modeling: Integrating Human Preferences with Verifiable Correctness Signals for Reliable Reward Systems

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:41.848273Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:41.848273Z digest=sha256:fe79e4cdef882698bde4b43ef981e5e148f54a83f0d0471d60b95f111d1ff515

Observation 7987d3da-ce64-422a-9779-f9d097f1d6a5 · outbound

This paper cites an unresolved cited work.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Unresolved cited work

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:41.916263Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:41.916263Z digest=sha256:c07236cc1b0d286dcd33f46b92be31a091f8785a93604b7cfd96b889468c4f22

Observation f9deeb4e-e44e-4dc1-b3b1-4aefd34e8f02 · outbound

This paper cites Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:41.981282Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:41.981282Z digest=sha256:b6d9db92fee6ce3516c5c7282019561ec0c7c8907339925d6ad7401f3831f511

Observation 6ce7f65b-9d25-468b-b1fc-5e6a28aaf0e9 · outbound

This paper cites an unresolved cited work.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:40:44.024575Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:40:42.091107Z digest=sha256:a3e726aca6c828153cc0702926acf2476f9f4fc795a5b74a069c0db093809fd0

Observation 03193b64-3997-472f-b58a-fb3fda932b77 · outbound

This paper cites Diverse Beam Search: Decoding Diverse Solutions from Neural Sequence Models.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Diverse Beam Search: Decoding Diverse Solutions from Neural Sequence Models

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:42.164794Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:42.164794Z digest=sha256:f9fef7e67f7ea8687765e4711873f49b44157f090378180ded26f8f95a88698e

Observation b3feee3c-4cff-4bec-80d7-48957c93de28 · outbound

This paper cites MCTS-Judge: Test-Time Scaling in LLM-as-a-Judge for Code Correctness Evaluation.

First Finish Search: Efficient Test-Time Scaling in Large Language Models MCTS-Judge: Test-Time Scaling in LLM-as-a-Judge for Code Correctness Evaluation

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:42.231068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:42.231068Z digest=sha256:2dc7ba130c9c0870b5d97a907bb113802afb25e234fd64bdb41b0a8359e90695

Observation 4fc7de80-569c-4865-9f02-3751b968a9cb · outbound

This paper cites Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:42.304124Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:42.304124Z digest=sha256:c7fbc197ef5ed70abe77ed345400def2616563f0298efe5790cb860763c03c55

Observation 07e50bf0-a5c8-4ad7-ade3-bd0e2263271b · outbound

This paper cites From Decoding to Meta-Generation: Inference-time Algorithms for Large Language Models.

First Finish Search: Efficient Test-Time Scaling in Large Language Models From Decoding to Meta-Generation: Inference-time Algorithms for Large Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:42.375970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:42.375970Z digest=sha256:a4c8833458384f2b1653c2fa48f7d5ee9cc33db81d1cc04002f54c9114a8b19f

Observation b7886825-e9f0-4228-9f38-d78df43c4302 · outbound

This paper cites an unresolved cited work.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:40:43.932992Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:40:42.439987Z digest=sha256:ab7405fe0bf5a105568e221d9d6c47c7662220bebb0d5db1aa8871ec5a8cee02

Observation aab6bc26-c491-4c70-a393-298260d74354 · outbound

This paper cites Monte Carlo Tree Search Boosts Reasoning via Iterative Preference Learning.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Monte Carlo Tree Search Boosts Reasoning via Iterative Preference Learning

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:42.491053Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:42.491053Z digest=sha256:a7141402540ec7761786bf7371fdc1aa4826754aeccc746d9a961d1816671e22

Observation 67a2b27c-f669-4e92-82c5-747935fa7ec6 · outbound

This paper cites Qwen2.5 Technical Report.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Qwen2.5 Technical Report

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:42.535646Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:42.535646Z digest=sha256:ea6065e38567c8da0649e35bf083a8039b62aaf699deb27f45830cfc38b4be2c

Observation c2ef4477-229f-4c36-a4d9-fa1df9c27b32 · outbound

This paper cites Qwen3 Technical Report.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Qwen3 Technical Report

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:42.616883Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:42.616883Z digest=sha256:fed0217c82c621e55ed60e5c2f3fe5f09f8422be4408fa9fcef61cb0aa794e1f

Observation e2f61140-d94d-4675-ba74-4790077aeae0 · outbound

This paper cites Step Back to Leap Forward: Self-Backtracking for Boosting Reasoning of Language Models.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Step Back to Leap Forward: Self-Backtracking for Boosting Reasoning of Language Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:42.686239Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:42.686239Z digest=sha256:49c987117245da8fa8015d9f2c4c6b9d48497bdee1beaf34462600869b1c04fd

Observation da283fa3-a8ac-4004-b05a-2ef47b81a6e6 · outbound

This paper cites A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?.

First Finish Search: Efficient Test-Time Scaling in Large Language Models A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:42.735954Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:42.735954Z digest=sha256:80407226362919c7ad7cdb01892f6cb0d13b8498989111c39a4bcec184fe9255

Observation 78f0f04c-8b72-4920-9d4d-bdc76f798214 · outbound

This paper cites Planning with Large Language Models for Code Generation.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Planning with Large Language Models for Code Generation

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T14:40:42.814618Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:40:42.814618Z digest=sha256:279b486490037758e3d99698a5e0f1b4331c6b10df74572c0600ebae3d74a3f9

Observation 6a0047ff-82ce-4a70-a95c-6fb8b39bc50b · outbound

This paper cites So, 22 = 4 does not divide n4 + 1for any n.

First Finish Search: Efficient Test-Time Scaling in Large Language Models So, 22 = 4 does not divide n4 + 1for any n

Reference 37

Resolution
verified exact
raw_fallback, observed 2026-08-07T14:40:43.459387Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:40:42.869321Z digest=sha256:dbc5ad0248f3eeb84a9115d33b6859cac7ab9e5f2d11f14720e0c78da9c85099

Observation 963f95f2-006d-4d81-a5fd-c4291c12c796 · outbound

This paper cites Find the least positive integermsuch thatm 4 + 1is divisible byp 2.

First Finish Search: Efficient Test-Time Scaling in Large Language Models Find the least positive integermsuch thatm 4 + 1is divisible byp 2

Reference 208

Resolution
metadata mismatch
raw_fallback, observed 2026-08-07T14:40:43.110325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:40:42.903751Z digest=sha256:71c7df1d7d41340bff6ac9945712cc15b73c7640cba2461df484408b0124adec

Pith citing papers

Observation fe208371-4307-450f-ae9a-f534c222f62b · inbound

Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey cites this paper.

Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey First Finish Search: Efficient Test-Time Scaling in Large Language Models

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T17:53:40.869843Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:53:40.869843Z digest=sha256:b10d47384bd7d522ec22617d40d8a6b8ff60261a1f09a64d3e8e288ab877b9d8

Observation 7b075402-bc0c-4bf8-9700-afa59a9af154 · inbound

EASE-TTT: Evidence-Aligned Selective Test-Time Training for Long-Context Question Answering cites this paper.

EASE-TTT: Evidence-Aligned Selective Test-Time Training for Long-Context Question Answering First Finish Search: Efficient Test-Time Scaling in Large Language Models

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-07-02T17:17:15.139638Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-06-27T22:05:00.537690Z digest=sha256:14f8d087b1471181c70b6b718a122e97ea6ed311c3cd4d88c2e2343e32754b9e