{"as_of":"2026-08-10T01:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cef5fa1b1a0c60afee6f3b012799ace64ad6b403cbe31ed376008c1d88ffad81","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:14:23.666202Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19634/citation-record","integrity":"/paper/2505.19634/integrity","json":"/paper/2505.19634/citation-record.json","paper":"/paper/2505.19634"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:20.849185Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:20.849185Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:cec04cd495265a9344abfac67ed24145ae1b8977a09d88424fe590e0c4da9d9e","observation_id":"aac5cdee-36ec-4931-83cd-e14e19b84e5d","resolution":{"observed_at":"2026-08-07T14:14:20.849185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:20.896928Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:20.896928Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:1b8e6e0a6cebde5bfbe97dc76089634e48f409d06b39e27765aa2676d926e555","observation_id":"d307be07-e554-4d3e-8550-97389933be11","resolution":{"observed_at":"2026-08-07T14:14:20.896928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05109","last_updated":"2024-10-07T16:21:29Z","snapshot_observed_at":"2026-08-03T23:07:15.667650Z","submitted_at":"2024-02-07T18:58:50Z","title":"Hydra: Sequentially-Dependent Draft Heads for Medusa Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05109","snapshot_observed_at":"2026-08-07T14:14:20.990978Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:20.990978Z"},"links":{"cited_paper":"/paper/2402.05109","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:3e71ec48dbbde5052325c308e19438faaa9f22d1e99eda50dca677041ff492ec","observation_id":"52ffbfa3-4311-478a-b7b2-70cf8f7e6922","resolution":{"observed_at":"2026-08-07T14:14:20.990978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:25.201634Z","title":null,"venue":null,"work_id":"267474f3-ce06-4f52-af09-8c965250d44e","year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.050136Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:5dfa4cf22ea7350bb2f018d4b044d6292acbcfb0962bbe1288202988aa2c6acf","observation_id":"7c906ed0-9dec-40a0-9909-6be861d3490c","resolution":{"observed_at":"2026-08-07T14:14:25.266685Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:25.015654Z","title":null,"venue":null,"work_id":"23b7079c-206b-4d8e-a0dc-0f9c8d7e5fe1","year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.137331Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:552a825898a6ef3269877ca9f550a805977819761a5d42e447693d52e22bc453","observation_id":"2475f915-e570-461e-b468-fe9f582b02c5","resolution":{"observed_at":"2026-08-07T14:14:25.109306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T14:14:21.211170Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.211170Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:9307ccc414ef16d229906e83a20a630a1a656e8c2466ab9e482d981d4f9894fd","observation_id":"83b2dbee-93be-4b24-afe5-63de353efd1c","resolution":{"observed_at":"2026-08-07T14:14:21.211170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-07T14:14:21.279768Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.279768Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:b582da01a21d846385946d82d5f9e0bdaebf28a8232c24499b59957f2863f682","observation_id":"bd6a1831-87fe-45e4-ad82-3e1bedfc5a75","resolution":{"observed_at":"2026-08-07T14:14:21.279768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-07T14:14:21.343342Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.343342Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:9ac36b85014ba5892bacc7d968d934b316b1aa9bfa7cd6ebc3502704b8f3e083","observation_id":"ad607972-c16e-439e-97a6-6881fe0a61a9","resolution":{"observed_at":"2026-08-07T14:14:21.343342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-07T14:14:21.428644Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.428644Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:0e77e21e7ccb1475ad024de117f80d7829ab2fc7d4898de3ee6ccf1485e49337","observation_id":"84de4233-7493-4613-a096-cdbfbc27b29d","resolution":{"observed_at":"2026-08-07T14:14:21.428644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05609","snapshot_observed_at":"2026-08-07T14:14:21.520298Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.520298Z"},"links":{"cited_paper":"/paper/2502.05609","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:20ab9d7e915129dd6a40664bfcff15158a52b503ffbdbb496db3042e6dcf4234","observation_id":"512295ff-e0ef-409b-94d9-2f00cf25795f","resolution":{"observed_at":"2026-08-07T14:14:21.520298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04519","last_updated":"2025-01-08T14:12:57Z","snapshot_observed_at":"2026-08-04T20:57:22.329262Z","submitted_at":"2025-01-08T14:12:57Z","title":"rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04519","snapshot_observed_at":"2026-08-07T14:14:21.569416Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.569416Z"},"links":{"cited_paper":"/paper/2501.04519","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:ebfc651cb9592b68a145cbb74e08194101e3874c4fd2c202b2fe466b3090c6dd","observation_id":"bf166085-f870-4f4d-bd71-c6c1dacb4a81","resolution":{"observed_at":"2026-08-07T14:14:21.569416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:14:21.669934Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.669934Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:928305c305df3965d51344db6eff2f8365c51cec8c9282e0c2cfdc2c67a596f8","observation_id":"ba8dbf1b-46b1-445b-9979-ef2715ad2f57","resolution":{"observed_at":"2026-08-07T14:14:21.669934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T14:14:21.759921Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.759921Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:bf92499502b3b2f99650be0502b5ebb8b85655fdcb8e074218e4d169c66b5e29","observation_id":"cbaab37d-1999-4ade-b959-bfd2b75494a2","resolution":{"observed_at":"2026-08-07T14:14:21.759921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:21.835787Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.835787Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:18f6d4942f2c603495c854f50c9f6b0d444a71e0321baacd12a4ba43f04e05db","observation_id":"2a0b5809-9035-4686-85b8-f5284a19deae","resolution":{"observed_at":"2026-08-07T14:14:21.835787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09891","last_updated":"2025-01-17T00:41:44Z","snapshot_observed_at":"2026-08-07T18:09:30.057330Z","submitted_at":"2025-01-17T00:41:44Z","title":"Evolving Deeper LLM Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09891","snapshot_observed_at":"2026-08-07T14:14:21.933314Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.933314Z"},"links":{"cited_paper":"/paper/2501.09891","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:ff0c6cfb35c379fdd9fe3adee4665dedb19f224819514e39871cece8b5cc7a14","observation_id":"ee65c85e-763f-4d02-8b89-2c59df45ac41","resolution":{"observed_at":"2026-08-07T14:14:21.933314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:22.011774Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.011774Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:3bac4f2bfec2c3da292a2a8bd323bfeaf07a32b33074991ac36fdee7738a19e7","observation_id":"048e12d2-b409-4c16-833b-57db1ee5873d","resolution":{"observed_at":"2026-08-07T14:14:22.011774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:24.858213Z","title":null,"venue":null,"work_id":"d71a914e-e1f6-40c6-be5b-3207b6349be6","year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.100607Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:3131a66204b19129b87fce370c68fb230b3c163d04928d519736fb32bc04815e","observation_id":"62d29a2d-c800-443a-a3d0-89b701e61319","resolution":{"observed_at":"2026-08-07T14:14:24.941453Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:24.668769Z","title":null,"venue":null,"work_id":"39b912c9-0947-4e75-b772-1430f35d7e1c","year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.192586Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:c8a801015178a9692beb8bead2ea01fdfbdea960a523f991e129a20afe49b774","observation_id":"2edbe66b-5b88-4e7d-ae3b-2b30a219c889","resolution":{"observed_at":"2026-08-07T14:14:24.773911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01840","last_updated":"2025-04-23T07:08:17Z","snapshot_observed_at":"2026-07-06T20:45:55.263034Z","submitted_at":"2025-03-03T18:59:04Z","title":"EAGLE-3: Scaling up Inference Acceleration of Large Language Models via Training-Time Test","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01840","snapshot_observed_at":"2026-08-07T14:14:22.274278Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.274278Z"},"links":{"cited_paper":"/paper/2503.01840","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:2090bc78f8d48566ec4371ec26c484962ad611c0d799b9308166ebcf40064100","observation_id":"006f8452-bf4b-4da0-a950-496d4078bd4a","resolution":{"observed_at":"2026-08-07T14:14:22.274278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-08T18:40:06.157350Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06703","snapshot_observed_at":"2026-08-07T14:14:22.357992Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.357992Z"},"links":{"cited_paper":"/paper/2502.06703","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:1daa2f27af09d234c1732c0ce1317a46a58304fe7952362445be533aa4cb06d6","observation_id":"770b0951-6d1e-4e04-80c8-1b81e777a340","resolution":{"observed_at":"2026-08-07T14:14:22.357992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:24.516164Z","title":null,"venue":null,"work_id":"74e094b5-fe36-409f-82bf-2e4bbca57e0e","year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.452686Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:0632a692a497c18136c2dfbc495aa593012180663f3c5129f91a7110aa33cb7a","observation_id":"d68c18c2-584f-499b-8e3d-c4226350db39","resolution":{"observed_at":"2026-08-07T14:14:24.594446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T14:14:22.505414Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.505414Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:b6e834b9679601a57866828d86a78ea7858d93432354468bacae3684084bfdff","observation_id":"d5be18d2-cd9d-4710-909e-f63f96d2644c","resolution":{"observed_at":"2026-08-07T14:14:22.505414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00114","last_updated":"2021-11-30T21:32:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-30T21:32:46Z","title":"Show Your Work: Scratchpads for Intermediate Computation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00114","snapshot_observed_at":"2026-08-07T14:14:22.568702Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.568702Z"},"links":{"cited_paper":"/paper/2112.00114","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:847bf1e8cd1266e68d4722e1266eba4e8de2269ea61d2b88e29d2b0fe871b78f","observation_id":"60d564a2-4815-4eae-a3a3-ec135f2e259e","resolution":{"observed_at":"2026-08-07T14:14:22.568702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:24.376837Z","title":"September 2024","venue":null,"work_id":"6f3eb3d8-d228-4ea6-9e1d-2101f3fc1228","year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.634383Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:c8bbe4245a8f5d88f8d7886465b3d5336d0e8a19d740dc4e03f2fd1c97f276a5","observation_id":"d5914a40-4819-44ac-87c7-e1d7cf7beea7","resolution":{"observed_at":"2026-08-07T14:14:24.445470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:22.697519Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.697519Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:8000a91e871f6a4cdf091897c6d2e96fb1df6e5ce84f559cfa53fc04dd3ebf15","observation_id":"42edd81e-fbf0-4256-8f71-d1834e4d9b6d","resolution":{"observed_at":"2026-08-07T14:14:22.697519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12118","last_updated":"2025-02-18T18:54:12Z","snapshot_observed_at":"2026-08-07T18:11:25.040275Z","submitted_at":"2025-02-17T18:43:24Z","title":"Scaling Test-Time Compute Without Verification or RL is Suboptimal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12118","snapshot_observed_at":"2026-08-07T14:14:22.796446Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.796446Z"},"links":{"cited_paper":"/paper/2502.12118","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:a03ac7aecaf29f920eed76044e96b56914af4cb21991b8ce4b7a34155bc96803","observation_id":"00262278-648d-401e-83b7-43a01aac0f27","resolution":{"observed_at":"2026-08-07T14:14:22.796446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10337","last_updated":"2025-04-16T14:58:26Z","snapshot_observed_at":"2026-08-07T16:05:50.114818Z","submitted_at":"2025-04-14T15:46:33Z","title":"Heimdall: test-time scaling on the generative verification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10337","snapshot_observed_at":"2026-08-07T14:14:22.894186Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.894186Z"},"links":{"cited_paper":"/paper/2504.10337","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:7f91791ab737d658569a8e9b59c3b796548c8819f68a3e4bba93da9322c7ccc5","observation_id":"89eb6f73-dcde-42a1-b3fd-c96b978da84e","resolution":{"observed_at":"2026-08-07T14:14:22.894186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:22.985586Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.985586Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:9523f484b23d751bcc0568f88c204ebd75f6578e2fa030772145b75eea9852c2","observation_id":"0d4cf23e-6a88-436b-a0f7-ed0547f2a68d","resolution":{"observed_at":"2026-08-07T14:14:22.985586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T14:14:23.077538Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.077538Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:a0130549016d4c08cacf4960c1e5bb8dec812f403f1fee0105e8e08d8d24b136","observation_id":"a7deb134-8cef-40b6-b5d0-244695c3b39d","resolution":{"observed_at":"2026-08-07T14:14:23.077538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:23.158186Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.158186Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:125760b99229f4222c9681d1a7f40db2b18f062b7945b7fc84631715978c7357","observation_id":"41ea4e1f-7967-4149-b3e2-257ab2c6bb58","resolution":{"observed_at":"2026-08-07T14:14:23.158186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09671","last_updated":"2024-10-12T23:42:16Z","snapshot_observed_at":"2026-08-08T14:45:36.681932Z","submitted_at":"2024-10-12T23:42:16Z","title":"OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09671","snapshot_observed_at":"2026-08-07T14:14:23.295558Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.295558Z"},"links":{"cited_paper":"/paper/2410.09671","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:9348a368445c6c199cafa71694e53f4977dca1632aa6bcfa567075fb97728dfb","observation_id":"67fdfbae-6c6f-4133-ab19-e02a88109ce1","resolution":{"observed_at":"2026-08-07T14:14:23.295558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04692","last_updated":"2024-06-07T07:04:10Z","snapshot_observed_at":"2026-08-07T21:51:22.136369Z","submitted_at":"2024-06-07T07:04:10Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04692","snapshot_observed_at":"2026-08-07T14:14:23.344701Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.344701Z"},"links":{"cited_paper":"/paper/2406.04692","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:74440ad7da41b7ed0c88db290d1d88355b0b930c07d42eb0afb7014a69de8d63","observation_id":"4a55ccb2-7b8f-43a4-b605-a5962d289216","resolution":{"observed_at":"2026-08-07T14:14:23.344701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-07T14:14:23.391333Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.391333Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:944d820a080e1f949fc71952ce82effa9c0c7af1f8d44676383c90338c03f064","observation_id":"4b206e90-f942-4f54-b449-7a5212cfd523","resolution":{"observed_at":"2026-08-07T14:14:23.391333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T14:14:23.470946Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.470946Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:3d65f71738c3accfd95b5bf033e47db9118efd00cd1c7dacd257e5e90b58f191","observation_id":"d5f2f4f7-22bc-4f41-bb88-a4411fed815d","resolution":{"observed_at":"2026-08-07T14:14:23.470946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:23.566465Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.566465Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:119ac4c08acbdade59abb2ee4567aee2f98009d86b048d7f01cd7e3ca6c4c210","observation_id":"c46c84db-aff2-47da-9adb-06ab2e074e8b","resolution":{"observed_at":"2026-08-07T14:14:23.566465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:24.178215Z","title":null,"venue":null,"work_id":"af89b0bb-b028-4e13-9ac8-e4339b302e8a","year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.610993Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:f35cd3b0009fb4e9e60c1409587f27bd57edda963921b056923ca34a1b0605f3","observation_id":"edf41162-daa5-4d41-bcd7-c1eeda2c85af","resolution":{"observed_at":"2026-08-07T14:14:24.243516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15240","last_updated":"2025-02-22T10:21:46Z","snapshot_observed_at":"2026-07-06T19:06:41.697671Z","submitted_at":"2024-08-27T17:57:45Z","title":"Generative Verifiers: Reward Modeling as Next-Token Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15240","snapshot_observed_at":"2026-08-07T14:14:23.666202Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.666202Z"},"links":{"cited_paper":"/paper/2408.15240","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:138e36e29be724c3e847e37f5043754690b9c1dd67cfb588b7a29beb1a69e9f1","observation_id":"b28ec7bd-1095-44a0-8644-3dc96c72738c","resolution":{"observed_at":"2026-08-07T14:14:23.666202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2505.19634."}