{"as_of":"2026-08-11T10:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:62f8cfc5d6ce8f07872c90c7ee690f021f60c8b778594608393d3660d6fb3f34","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T19:40:23.148446Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T17:29:36.978463Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T10:37:01.586875Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":"2502.00271","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00271","snapshot_observed_at":"2026-07-10T10:37:01.586875Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","venue":"cs.CL","work_id":"aca657e0-e3f9-4989-b70b-4b8992d89aba","year":2025},"citing_paper":{"arxiv_id":"2607.08256","last_updated":"2026-08-05T11:29:52Z","snapshot_observed_at":"2026-08-09T05:16:57.005864Z","submitted_at":"2026-07-09T09:01:03Z","title":"Best-of-$N$ TTS Evaluation is Confounded by ASR Family Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-10T10:31:23.170749Z"},"links":{"cited_paper":"/paper/2502.00271","citing_paper":"/paper/2607.08256"},"observation_digest":"sha256:4af6fd2907fd03dfdc93bd181e9998042dad822bb587a6c4762cbde4f6982b75","observation_id":"aa2d8285-e5e1-4178-9e02-f0c1cab4405f","resolution":{"observed_at":"2026-07-10T10:37:01.588242Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00271","snapshot_observed_at":"2026-08-01T17:29:36.978463Z","title":"arXiv:2502.00271","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17641","last_updated":"2026-07-20T07:52:36Z","snapshot_observed_at":"2026-08-08T07:46:10.530796Z","submitted_at":"2026-07-20T07:52:36Z","title":"Verify, Repair, Repeat, or Stop? Robust Stopping for Noisy Verify-Repair Loops in LLM Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T17:29:36.978463Z"},"links":{"cited_paper":"/paper/2502.00271","citing_paper":"/paper/2607.17641"},"observation_digest":"sha256:84407a0f27b85c2a844e1fe1df6b1824b9ecfc4ff4c281779243fce3f6733962","observation_id":"7de6432c-46c4-449b-aaab-3c62782a9a9c","resolution":{"observed_at":"2026-08-01T17:29:36.978463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00271/citation-record","integrity":"/paper/2502.00271/integrity","json":"/paper/2502.00271/citation-record.json","paper":"/paper/2502.00271"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:40:23.069698Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.069698Z"},"links":{"citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:5e761487ac26baaafe6e08ad0985c450404cd9175db749c70c1a94aed0694626","observation_id":"744e3e67-edb8-492d-bfa8-7df699e64bd7","resolution":{"observed_at":"2026-08-09T19:40:23.069698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-09T19:40:23.074525Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.074525Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:e9de839999a729f9adbcb8549550ea6edba2cdb1f9e3712ac976bfaaeebabcb8","observation_id":"a5849c0e-2c78-44af-a983-d54180a1beff","resolution":{"observed_at":"2026-08-09T19:40:23.074525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03553","last_updated":"2024-09-27T08:16:28Z","snapshot_observed_at":"2026-08-08T14:49:36.757543Z","submitted_at":"2024-05-06T15:20:30Z","title":"AlphaMath Almost Zero: Process Supervision without Process","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03553","snapshot_observed_at":"2026-08-09T19:40:23.078834Z","title":"Alphamath almost zero: process supervision without process","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.078834Z"},"links":{"cited_paper":"/paper/2405.03553","citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:6f9889630a7bc122df225602577882d0bf5eb49a512274b2ab78c4bddb3749bf","observation_id":"85ff0d55-9264-4da6-917e-1d6b3c42b054","resolution":{"observed_at":"2026-08-09T19:40:23.078834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-09T19:40:23.084259Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.084259Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:00d04f98395d114eb284e3b1c5e172f810343351db5be72cbc9dd44e567f291e","observation_id":"3e9559b4-f024-43c5-a1dc-e18742691358","resolution":{"observed_at":"2026-08-09T19:40:23.084259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-09T19:40:23.088985Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.088985Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:4f78ee1951fd80db83be9a0fbc8c250717f38b98a2dbbd119463f9d86d575ce8","observation_id":"883e0dc8-ed61-4fd2-935b-44b01fd060ce","resolution":{"observed_at":"2026-08-09T19:40:23.088985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:40:23.092881Z","title":"J., Wang, Z., Wang, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.092881Z"},"links":{"citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:a0a19254b3834ea091ee5a90d61c444ed838aeadf2aee96e8fb85ef4826d18d7","observation_id":"93709917-bd33-4624-9e93-69c7db90de06","resolution":{"observed_at":"2026-08-09T19:40:23.092881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:40:23.552861Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":"980573b3-eb76-440b-9f73-5f010b081e25","year":2021},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.096843Z"},"links":{"citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:e6811fe78d34a5b4e2fae5e07ebc666004bd0c149faeb4b2f4cc5a1df777810a","observation_id":"ba09c96f-2afa-4c7d-a301-a4757b22fd5d","resolution":{"observed_at":"2026-08-09T19:40:23.557217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-09T19:40:23.100597Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.100597Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:7e6d5940778dd4c411c6c84401106a9938e0fdbfd6f07105427968c0a95fb24c","observation_id":"0e88601e-a161-439b-bb66-ee0815d695ed","resolution":{"observed_at":"2026-08-09T19:40:23.100597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:40:23.483382Z","title":"H., Gonzalez, J., Zhang, H., and Stoica, I","venue":null,"work_id":"64d9ce22-7693-4991-ab2c-883dd362d2d9","year":2023},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.104679Z"},"links":{"citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:2b54e8e0bdd013a5459a9fd37b1fc3360d758a79408bc1b3aabd56ce1ece91ae","observation_id":"ff44c0ef-ab54-4673-8528-658213c76270","resolution":{"observed_at":"2026-08-09T19:40:23.489714Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:40:23.542824Z","title":"Let's verify step by step","venue":null,"work_id":"cb2bf863-85e2-4a86-9dd7-0b66ace79709","year":2024},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.108121Z"},"links":{"citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:b5570d13b7d68c4bcf2c472640e01a43a823a82395142f345d744c936e7b5a6c","observation_id":"8e48135d-87d9-4bec-af31-c4db065f570c","resolution":{"observed_at":"2026-08-09T19:40:23.546210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:40:23.112056Z","title":"and Hutter, F","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.112056Z"},"links":{"citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:dcdaadbc7d39d4e4da364427aac8637dcb7289b8a593a56506ec723f08c4c23c","observation_id":"aadf6fb9-04b0-4ee2-8b39-30aeef6e620f","resolution":{"observed_at":"2026-08-09T19:40:23.112056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-09T19:40:23.115838Z","title":"K., Wu, Y., and Guo, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.115838Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:e9196785b74fa5b2aba055235ec184f1e628a75feabf74ec33e1ac5e7ac16168","observation_id":"549205b8-de25-4e71-ae92-1083ba1de86b","resolution":{"observed_at":"2026-08-09T19:40:23.115838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-09T19:40:23.119992Z","title":"Scaling LLM test-time compute optimally can be more effective than scaling model parameters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.119992Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:259adec830d77eba7f55e523fe58db447b62981f73337f123a453b60a8a4cb48","observation_id":"8a7779d7-5f82-4fbb-8b6c-2f3340ab25bb","resolution":{"observed_at":"2026-08-09T19:40:23.119992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12253","last_updated":"2024-12-10T18:19:29Z","snapshot_observed_at":"2026-08-05T22:35:55.296192Z","submitted_at":"2024-04-18T15:21:34Z","title":"Toward Self-Improvement of LLMs via Imagination, Searching, and Criticizing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12253","snapshot_observed_at":"2026-08-09T19:40:23.123889Z","title":"Toward self-improvement of llms via imagination, searching, and criticizing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.123889Z"},"links":{"cited_paper":"/paper/2404.12253","citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:f55d400a077b90ed37bfad69f547b9cfa183fa41b4ef243362f640dc54d0797b","observation_id":"c5f33746-c561-443d-820b-d1dac2d91379","resolution":{"observed_at":"2026-08-09T19:40:23.123889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:40:23.525676Z","title":"M., Wen, Y., Zhang, W., and Wang, J","venue":null,"work_id":"c8a91239-5d6d-4d74-b012-47b1dd79a349","year":2024},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.127555Z"},"links":{"citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:33f42f032786e1c165b941206aab6984eae3ac9ca1181bf8f4dfa9f0c51a248d","observation_id":"0a65fbfb-aec7-4eb8-8dd8-78ba994b1e88","resolution":{"observed_at":"2026-08-09T19:40:23.529149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:40:23.130971Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.130971Z"},"links":{"citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:45a1143f0c7236f7f701700272b49e3eafc5035b32b6f58d70b79be628f79fa7","observation_id":"0addff3a-e015-46a8-bace-23efde81ee20","resolution":{"observed_at":"2026-08-09T19:40:23.130971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-08-09T23:53:42.648697Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00724","snapshot_observed_at":"2026-08-09T19:40:23.134519Z","title":"An empirical analysis of compute-optimal inference for problem-solving with language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.134519Z"},"links":{"cited_paper":"/paper/2408.00724","citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:6dc8dffd47c02cdab630aec0e56b40c2673f4dffcfaca5e7cc986d3b010e9c7f","observation_id":"033fa8bd-02a4-4f7c-aaeb-a549158c2163","resolution":{"observed_at":"2026-08-09T19:40:23.134519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-08-09T23:53:42.648697Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00724","snapshot_observed_at":"2026-08-09T19:40:23.138069Z","title":"Inference scaling laws: An empirical analysis of compute-optimal inference for problem-solving with language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.138069Z"},"links":{"cited_paper":"/paper/2408.00724","citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:115b767f16bde8135a7e5f23471a4c6cf757174d50ff1db511d23dac34be17e2","observation_id":"108c777e-5545-419b-ad46-2e8ae8f06ef1","resolution":{"observed_at":"2026-08-09T19:40:23.138069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08152","last_updated":"2024-08-15T13:40:03Z","snapshot_observed_at":"2026-08-11T02:42:54.135677Z","submitted_at":"2024-08-15T13:40:03Z","title":"DeepSeek-Prover-V1.5: Harnessing Proof Assistant Feedback for Reinforcement Learning and Monte-Carlo Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08152","snapshot_observed_at":"2026-08-09T19:40:23.141252Z","title":"Z., Song, J., Shao, Z., Zhao, W., Wang, H., Liu, B., Zhang, L., Lu, X., Du, Q., Gao, W., Zhu, Q., Yang, D., Gou, Z., Wu, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.141252Z"},"links":{"cited_paper":"/paper/2408.08152","citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:42a500fbeea3d3edcd3a7560d338f615b9b1a8a6d2cad483faeb2e48b2f54960","observation_id":"27f6e7b4-c7cd-4c8a-99a2-6dc6050eb82b","resolution":{"observed_at":"2026-08-09T19:40:23.141252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:40:23.145024Z","title":"Ovm, outcome-supervised value models for planning in mathematical reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.145024Z"},"links":{"citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:37da0cc36e6d0d2aad8aa4d35ecd9d088f53e3a9a9dd927c0ae3cf31d5a362cc","observation_id":"6ca27096-e68d-43a5-86dc-72956e4c92ee","resolution":{"observed_at":"2026-08-09T19:40:23.145024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:40:23.515086Z","title":"M., and Polu, S","venue":null,"work_id":"48ffb08c-971f-434f-91ed-7b2ad59017cd","year":2022},"citing_paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T19:40:23.148446Z"},"links":{"citing_paper":"/paper/2502.00271"},"observation_digest":"sha256:44de8b12827964b28fd152738a162a7362ca0266def25f0fccd55f42432aca35","observation_id":"eda9567d-7538-4fd0-a6f4-4fd1e9d90385","resolution":{"observed_at":"2026-08-09T19:40:23.518634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.00271","last_updated":"2025-02-01T02:08:49Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T19:33:40.106138Z","submitted_at":"2025-02-01T02:08:49Z","title":"Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":4},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 2 inbound Pith citation observations for arXiv:2502.00271."}