Pith. sign in

Paper Citation Record · LEDGER

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models

As of 16 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2507.15512.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.15512 v3

Coverage vector

measured 54 of 54 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T15:37:24.974376Z

measured 54 of 54 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-16T06:30:59.297886+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

54 of 54 outbound references displayed

  • verified exact0
  • verified fuzzy1
  • unresolved52
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 3fb0fe32-d866-4d42-a53a-1af59abac6f5 · outbound

This paper cites online" 'onlinestring :=.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models online" 'onlinestring :=

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.848566Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.848566Z digest=sha256:80ad4f7ff30ddaea844def3abc1e69a01c9c2b17353ef239bb8de42f9b0e6f0f

Observation 1e472068-85f0-41fa-85f2-924d6c0ea33c · outbound

This paper cites write newline.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models write newline

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.853986Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.853986Z digest=sha256:2cc363e17c87c41641cd38c433c1f587008a50e6e5f4ba7e0089c4cd54403b17

Observation 06ed4b1f-d4ed-4cc3-b07b-41f36c918a98 · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.856899Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.856899Z digest=sha256:592647763495e26429c718f51e64e38df0b892c68ae896d0a5c685257bf48d53

Observation 00d2d16e-e232-4f97-b42b-9ff633586a45 · outbound

This paper cites Large Language Monkeys: Scaling Inference Compute with Repeated Sampling.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Large Language Monkeys: Scaling Inference Compute with Repeated Sampling

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.860769Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.860769Z digest=sha256:41b636a549beeb69c79c0e99741aafc84dcfcfd1fff5471cb914dbea1068f96b

Observation 0888cbf8-91aa-4517-a4cf-70e55c111605 · outbound

This paper cites Efficient Prompting Methods for Large Language Models: A Survey.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Efficient Prompting Methods for Large Language Models: A Survey

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.863525Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.863525Z digest=sha256:250974f54c19cbea2f2cd39dc5e5faac60d60b292c2ccfc771c01d94287bf5d8

Observation fec87c8d-ba97-4723-9c28-e1dca317d7b0 · outbound

This paper cites Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.865956Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.865956Z digest=sha256:8999692012e999515644d45f8a92af0638b34dca22c08de8eabf7d231c6aa832

Observation 387a8b27-0780-4018-8b0b-d7d4ae9d039c · outbound

This paper cites Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.869021Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.869021Z digest=sha256:5e3738f37cac79cd6b677447d9ec488b60f44ced79cb612be9ad1dddb4012fda

Observation cf468863-344c-42fa-8c3d-fbdcf602386d · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.872325Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.872325Z digest=sha256:80ad94383ff8852b9809660753fdcbba4bc53b464534cf7b69d612b5e7b3a705

Observation bf547cc7-471a-431c-a0fa-dd6c01112d2b · outbound

This paper cites Dynamic Parallel Tree Search for Efficient LLM Reasoning.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Dynamic Parallel Tree Search for Efficient LLM Reasoning

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.874870Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.874870Z digest=sha256:8b10d141427bb189531bb8bf3f9acd3b78d94881d64038a4f43224f8fe17dad8

Observation b919a394-ae99-48ee-a1d0-fda14ca763de · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.287141Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.877196Z digest=sha256:691d6f860c622998127ddfbb1ecf49036292b7b593032c3717fbe6a6423019e4

Observation 79fffff3-dc27-4602-9fb6-b8e1030a7516 · outbound

This paper cites CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.879489Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.879489Z digest=sha256:f789eb9ccbffb6caff9017d9ff879fef1a14e0930e459ab06a68e05d13434ba2

Observation 8794fd29-cfe3-42de-8b6e-43d1c798a70c · outbound

This paper cites The Llama 3 Herd of Models.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models The Llama 3 Herd of Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.882178Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.882178Z digest=sha256:71ec68a180d26daa09625103371a1802c7a80c4f336385bea7809e0cef5a1f0f

Observation fd5cbf11-bbb8-4adf-9c00-05a41dab1f82 · outbound

This paper cites Measuring Mathematical Problem Solving With the MATH Dataset.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Measuring Mathematical Problem Solving With the MATH Dataset

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.884204Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.884204Z digest=sha256:2a21a54eafc13bdc2d5b1b1f59c7e2a2e2b61aaeeeb9626281517fc69f9ae332

Observation 270f58dd-1586-44d9-b353-99dc74c54396 · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.280708Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.886512Z digest=sha256:be0413f6340dddf02a21fbefaf5c4dca632feb9d9b01fd9b7d7ab0796a51272b

Observation 32281b08-23e6-4e8c-8a35-9f3f0d922fae · outbound

This paper cites A Survey of Test-Time Compute: From Intuitive Inference to Deliberate Reasoning.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models A Survey of Test-Time Compute: From Intuitive Inference to Deliberate Reasoning

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.888836Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.888836Z digest=sha256:de21c8e6a02ea6882441c5afb32a5dea1603118f58b8a7b878b101fefef79e04

Observation 1f219167-10ac-4d6a-82cf-37dfdece25e0 · outbound

This paper cites MindStar: Enhancing Math Reasoning in Pre-trained LLMs at Inference Time.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models MindStar: Enhancing Math Reasoning in Pre-trained LLMs at Inference Time

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.891071Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.891071Z digest=sha256:59bcbbc1f8a3c823f1d6e3e09cd1ed67d88bbe22e1b21669ffec1c160f5cf4db

Observation 122bc742-36ce-4876-a508-ca2ceaf498f3 · outbound

This paper cites Scaling Laws for Neural Language Models.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Scaling Laws for Neural Language Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.893285Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.893285Z digest=sha256:94a44403dc276f8da9b7d01da52c59ba707498eaff1d1c23427b893c374ab45d

Observation cd30e8d6-b71f-4d93-9b37-cce2ecf9e573 · outbound

This paper cites Gonzalez, Hao Zhang, and Ion Stoica.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Gonzalez, Hao Zhang, and Ion Stoica

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.895591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.895591Z digest=sha256:b77d3d8343d3b0c529031bf95f9dfd1da0d0fa2f0c50c9681a12ca6367fb68c2

Observation 25fa7974-b8ca-4780-b4e5-9fc7d7d2fc39 · outbound

This paper cites From System 1 to System 2: A Survey of Reasoning Large Language Models.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models From System 1 to System 2: A Survey of Reasoning Large Language Models

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.897708Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.897708Z digest=sha256:9176e7938d0ecb56f5e5df79a5a00cdc1ec0605885105e06bd14da06a9610e12

Observation 93694884-1d37-48aa-9d6c-fe9a1fb6f47f · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.900251Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.900251Z digest=sha256:7a6245067d5689034a4c8fe31d9b91daad61ef32b1e6e61b4575b338449e4995

Observation 94a41992-67de-4659-88cf-986d501d1dac · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.266832Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.902306Z digest=sha256:598f067b6364becc67de4d22508a495a94d7ab0f5ea483c9b8b2b0e6c6627c1b

Observation 7d89afc0-0d57-4e87-8861-e1e16611743d · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.259854Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.904368Z digest=sha256:aa4e24c6bbd144f65cff804f2554ed90a586c9ebff935842e721858d3297d1fe

Observation 0dc4419a-3029-4923-8ceb-d323da4ce8fe · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.253476Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.906307Z digest=sha256:401d358ccf63833d97fc0b7a57c29e053ba34db1f5d02a9e6260e13e75d8160a

Observation 8f289958-4208-4114-9432-419e4611a362 · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.246885Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.908421Z digest=sha256:fe13792f6872ba1934b85c3f9b89042335f0cd486b912d1bd1725936b82e1615

Observation af9f2b31-e30b-4a7a-8262-590c58eb3025 · outbound

This paper cites s1: Simple test-time scaling.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models s1: Simple test-time scaling

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.910293Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.910293Z digest=sha256:a57237d1c073336666be0fe26aea40d054778c555c86e78a967818b62ea1b740

Observation de22a193-3e29-4776-8967-80c4c52146bb · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.240689Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.912448Z digest=sha256:74a855cc8502798707fe74ff929011f63b6653247f81a200db286265e3b724e2

Observation 54efe568-fdcf-4759-b2bb-ba8298b473d7 · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.233762Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.914826Z digest=sha256:a9d9a839f52f673f7979f68556bec4ae3795f3a994a18d04295751ec1347b089

Observation 3d9c8bdf-a42b-4db3-b90f-a95684e72fd2 · outbound

This paper cites MC-NEST: Enhancing Mathematical Reasoning in Large Language Models leveraging a Monte Carlo Self-Refine Tree.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models MC-NEST: Enhancing Mathematical Reasoning in Large Language Models leveraging a Monte Carlo Self-Refine Tree

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.916693Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.916693Z digest=sha256:47ae860bce945b552afc74693a83d04d5a1fae27c7a50b95ff0e63a06b5bcf79

Observation ded48cee-0d04-43ff-beca-400b55807270 · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.919131Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.919131Z digest=sha256:3d1422d17f14408685e7ee526a3164168eafa02c889ba27601c9f24bed702582

Observation 8fc70004-692f-4544-9468-1df91cef1faf · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.223708Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.921365Z digest=sha256:a2e45f8b2409c25ee51ad217a21a7a1230ec2197f66da9e937b3f11950142f80

Observation 56eda410-0fa7-473f-936f-6e655336c53b · outbound

This paper cites DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.923893Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.923893Z digest=sha256:ff83e2ef1e2cf93d815a1c962dc662fd6e58d4d9f60a65efbade8955285b5dfd

Observation 255745b6-cfa4-4de7-8ab4-231be8d982ba · outbound

This paper cites Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.925962Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.925962Z digest=sha256:f30277c739f79d77af0da2cfde1e9bdff25658a7c05395acf370f10d88f49264

Observation cf571c63-c71a-4caa-946a-eea22154689b · outbound

This paper cites PRMBench: A Fine-grained and Challenging Benchmark for Process-Level Reward Models.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models PRMBench: A Fine-grained and Challenging Benchmark for Process-Level Reward Models

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.928392Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.928392Z digest=sha256:18607efd5876ea9b7b4b623b8fe4f0d014a185cfed5581e8e31007d3ce80f5c1

Observation 31c72ada-d685-449e-8af8-0f8c0db39c97 · outbound

This paper cites Gemma 3 Technical Report.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Gemma 3 Technical Report

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.930558Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.930558Z digest=sha256:a737b03178779e5f5e8fb4384c110c37042b4ac230e462dee7abeef0c743468d

Observation 942872f9-e760-4cfb-8a5f-5c709f276273 · outbound

This paper cites Solving math word problems with process- and outcome-based feedback.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Solving math word problems with process- and outcome-based feedback

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.932824Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.932824Z digest=sha256:fa51775276f748daab9d03c86d0de58726d0da4ffcf0abe85a7d04ea26f22036

Observation fe7517a8-eff5-442b-81c5-822196e81a48 · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 36

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.217484Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.934824Z digest=sha256:bcd27929d6e4a60ee402cf28e6478c8bdf1d4ff00c130338dea1b48f7ca8d8bf

Observation 3ea2de8a-6282-446c-b3c8-dcb133f67084 · outbound

This paper cites OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models

Reference 37

Resolution
malformed identifier
no resolver link, observed 2026-08-06T15:37:24.936924Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.936924Z digest=sha256:f0119ba0b40c44bf25cac8cedba13d8729fc3450a9b050e3ff4c146d795d57b6

Observation c1d1a203-5b25-4b88-83ee-0776460c306d · outbound

This paper cites Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.939339Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.939339Z digest=sha256:87ad09baa658e933728d8ae092dbc6d09e63fd7ebfb78dea23e96556142f4c7e

Observation 15a8f3ad-d36f-491d-b35c-69e2c695b8dd · outbound

This paper cites Le, Ed H.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Le, Ed H

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T15:37:25.211239Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.941418Z digest=sha256:6c56c0cfeb4beb7865fd7ebc7aed08c0f2db9bdda9e93fcbe701433ea0c62c96

Observation 01f4e93f-2cbf-4427-8840-5990a60af7c4 · outbound

This paper cites Chi, Quoc V.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Chi, Quoc V

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.943275Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.943275Z digest=sha256:6263046f5186cd09059a8b60e89b9254dde319dfffe78ff2fe55f872912ebbd4

Observation 079a00e7-b7f0-40a1-8453-95ada4905eb1 · outbound

This paper cites Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.945481Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.945481Z digest=sha256:055dec741db80305f3d97647c113a018f7d01d1fa8f96604e03b2f8dafea251d

Observation 888b3b45-63a5-4bf8-a25e-c57afb5d0ea5 · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 42

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.200649Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.947418Z digest=sha256:68a85ee06fcd865ab69e37c90d5803693d8194abbb0243ec24a00e931bf8c776

Observation 47daccca-fc97-4a3f-a989-a7a8b31a624a · outbound

This paper cites Foundations of Large Language Models.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Foundations of Large Language Models

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.949552Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.949552Z digest=sha256:abbd314147e90a025f06f58e53c975f16e7497bef71ebaa7abd3b63ed6be4561

Observation 663df73f-68df-4176-9922-391a9287f81a · outbound

This paper cites Qwen2.5 Technical Report.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Qwen2.5 Technical Report

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.951647Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.951647Z digest=sha256:e3484e8a664c68e28d895b37bff7123b35fe2d8ca82e6648444e25d930492144

Observation a27e4034-1814-4d89-afa5-11b468fa5a14 · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 45

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.193983Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.953990Z digest=sha256:89df1ffa4f372f52641f2e749c76e4d30c6338c39b2b34afd7c01e166dff50e3

Observation 40a8dd28-cd25-4b90-86d0-9a9856adc807 · outbound

This paper cites DAPO: An Open-Source LLM Reinforcement Learning System at Scale.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models DAPO: An Open-Source LLM Reinforcement Learning System at Scale

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.955844Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.955844Z digest=sha256:8fc6ce4a39a169c8dd856f39d52771b81389ac820593b0e2139d19bd3970b5ab

Observation a1ecf1ba-7fac-4019-a561-0bda22fb1dce · outbound

This paper cites Accessing GPT-4 level Mathematical Olympiad Solutions via Monte Carlo Tree Self-refine with LLaMa-3 8B.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Accessing GPT-4 level Mathematical Olympiad Solutions via Monte Carlo Tree Self-refine with LLaMa-3 8B

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.957990Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.957990Z digest=sha256:3abd49f96ebfe956ee89bba4c3c8c7a27e43ba23574ddbfc949cd8442acb3356

Observation 98a9c10f-eba1-46ef-b98e-3ff54639620e · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 48

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.187756Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.960189Z digest=sha256:01c29ad46ddb1fe753726749dd72d20ec4ca3073fb346e17e5bb1b33af4d775c

Observation 1bfd7f65-1aeb-45a8-a77f-4127ea42aed0 · outbound

This paper cites an unresolved cited work.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Unresolved cited work

Reference 49

Resolution
unresolved
raw_fallback, observed 2026-08-06T15:37:25.181254Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-08-06T15:37:24.962130Z digest=sha256:ff507e12ff62e76dcdb42696555b319bf14a85c2aa49286781b2b95e4c9853eb

Observation 109efe03-ab17-4f2a-b832-038edf186e46 · outbound

This paper cites A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.964766Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.964766Z digest=sha256:91d0e3e3bcedd402c624e691dedec58acaaa9216af11e39c69b9521af8afd6a5

Observation 8f21145a-2da8-4827-b183-28c5bb86f8d7 · outbound

This paper cites Small Language Models Need Strong Verifiers to Self-Correct Reasoning.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Small Language Models Need Strong Verifiers to Self-Correct Reasoning

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.967055Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.967055Z digest=sha256:e8fb1d59b4a1c689ec6d1cf189ac1e456cbb19c0f14f7f1a9fbdeef344da0456

Observation d07800da-c014-48f5-a681-d6d9f3143dd2 · outbound

This paper cites The Lessons of Developing Process Reward Models in Mathematical Reasoning.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models The Lessons of Developing Process Reward Models in Mathematical Reasoning

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.969856Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.969856Z digest=sha256:5bc60e09bbb8bc43608104dd4d12ffc9fefa6d5df8ed851df04e9f4b26539e23

Observation afad08a3-61b1-4782-8c08-1af9a7c37026 · outbound

This paper cites Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.972019Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.972019Z digest=sha256:7c7c593ea44b1977935f97fd8c1ce1f07f04264dfc70ef96dcf4af5a901be68b

Observation cb2dd002-b98d-4d15-a457-1b9382094597 · outbound

This paper cites Learning to Reason via Mixture-of-Thought for Logical Reasoning.

Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Learning to Reason via Mixture-of-Thought for Logical Reasoning

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-06T15:37:24.974376Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T15:37:24.974376Z digest=sha256:1ef085c420e2db54b4fac6d4c31276451e8d7a8c9168c3886a6c6b90ad6ff98c

Pith citing papers

No inbound Pith citation observations are available.