{"as_of":"2026-08-12T10:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dead357b1e952094c81139e300642bef72d3af05b7b21f291431f32662bcdcef","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T06:01:49.694046Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:26:51.781825Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T10:31:04.030419Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"cited_work":{"arxiv_id":"2506.06470","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06470","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jeff Rasley, Samyam Rajbhandari, Olatunji Ruwase, and Yuxiong He","venue":null,"work_id":"52205816-46a4-4c5e-8cee-577ec5b78ddf","year":2020},"citing_paper":{"arxiv_id":"2604.11365","last_updated":"2026-04-13T12:05:34Z","snapshot_observed_at":"2026-07-06T22:59:45.139155Z","submitted_at":"2026-04-13T12:05:34Z","title":"Learning from Contrasts: Synthesizing Reasoning Paths from Diverse Search Trajectories","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T15:26:51.781825Z"},"links":{"cited_paper":"/paper/2506.06470","citing_paper":"/paper/2604.11365"},"observation_digest":"sha256:ef9714b2fb448686c233979e99864c7850da717cb86d866bde9defab68afcb45","observation_id":"a4bcaedc-7181-453a-bd8c-bc2fa7cad811","resolution":{"observed_at":"2026-05-11T10:31:04.034080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.06470/citation-record","integrity":"/paper/2506.06470/integrity","json":"/paper/2506.06470/citation-record.json","paper":"/paper/2506.06470"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T06:01:49.535743Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.535743Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:c3ef2c23d1a996714f898ef7b6108100d9435b2e7acf67b3f814f9e8a5b0f372","observation_id":"e7aacfc1-b571-47ed-b24b-2b7462e771a1","resolution":{"observed_at":"2026-08-07T06:01:49.535743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.123256Z","title":"Self-RAG: Learning to re- trieve, generate, and critique through self-reflection","venue":null,"work_id":"deb9240b-57d9-415f-abfd-e9f502ec3826","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.540087Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:fe7c428fea0eb7bd87dbc365fe627eaa100a555fbec02aa0101c9caa1697e120","observation_id":"27a2278c-5993-44af-885a-70f84c5338be","resolution":{"observed_at":"2026-08-07T06:01:50.126089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.543320Z","title":"Graph of thoughts: Solving elaborate problems with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.543320Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:21fd357fdb04f5b4843628846165659c9cebb1af29c12dfe779e246b0a555ae8","observation_id":"2a511bd8-673f-43b9-bb86-36006c8bdcb9","resolution":{"observed_at":"2026-08-07T06:01:49.543320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.109734Z","title":"Byrd, Robert Zinkov, and Nada Amin","venue":null,"work_id":"143f8463-bb4d-4ae2-9061-d863edf2264f","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.546410Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:f08d66261763b9af40c5d4d64758eb54903be88607f22a4143269df8247a5348","observation_id":"e81bcf8a-c967-4848-bfb8-61d8cb6aa025","resolution":{"observed_at":"2026-08-07T06:01:50.112293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-07T06:01:49.549758Z","title":"Large language monkeys: Scaling inference compute with repeated sampling.arXiv preprint arXiv:2407.21787, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.549758Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:fb0c2b4305f606eeee970786e05f23683a0394cd4a1b9e2a32348eb5f937783d","observation_id":"97fb398d-f726-4260-8363-3e2eacb7947c","resolution":{"observed_at":"2026-08-07T06:01:49.549758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.101736Z","title":"Alphamath almost zero: Process supervision without process","venue":null,"work_id":"9f16c443-0504-48f0-82aa-34ff5d1d9d19","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.553119Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:a7f52771e99351f3c163918f9452b2d5decc4cc46e48762e0f081f78b908cdfb","observation_id":"f3f1fca1-093c-4983-ab00-79e831f20474","resolution":{"observed_at":"2026-08-07T06:01:50.104437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.093691Z","title":"Divide-and-conquer meets consensus: Unleashing the power of functions in code generation","venue":null,"work_id":"c60692c3-c4f2-4f18-a9af-559520515b32","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.556554Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:7b146b74b0f526768767fb5d4bc0c3cb7e00423003677329eb4e01bdea750862","observation_id":"d04d8f75-798d-4b10-90b1-b436e9db4eae","resolution":{"observed_at":"2026-08-07T06:01:50.096407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.085131Z","title":"TheoremQA: A theorem-driven question answering dataset","venue":null,"work_id":"d7d9a5ae-cf89-4a2b-83cc-12a5671449c0","year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.559347Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:8f2317c6016908c83fc64850300aefb1e8ce3b428c578ae9fcbbab7f2bf2651e","observation_id":"6964d4f8-fdea-4b04-baba-d7a86d172e36","resolution":{"observed_at":"2026-08-07T06:01:50.088217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T06:01:49.565560Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.565560Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:e6c2ef25e075f2076abd4811c50d12f60aee327c3f8a579a9cec551b4fbe479b","observation_id":"97b3ee0f-0e34-4f5f-ba37-f1ccb585f16b","resolution":{"observed_at":"2026-08-07T06:01:49.565560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.076695Z","title":"ToRA: A tool-integrated reasoning agent for mathematical problem solving","venue":null,"work_id":"50b6570d-2067-4062-97dd-f7fabec451a7","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.568585Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:36784ceb9b95f984c3cbf376f69cd5b39f5cf74311feacd14cb092fb8c9dae85","observation_id":"e542f507-00ec-4d11-b3cb-f56b8b06c383","resolution":{"observed_at":"2026-08-07T06:01:50.079581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T06:01:49.571575Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.571575Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:8111e2e323ac3e46b1479ad218e3b6be7f3f1b6175e580c1a9d3b2b8a08cec25","observation_id":"8eb09dac-5e12-44bc-ada9-c3b04b505730","resolution":{"observed_at":"2026-08-07T06:01:49.571575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.068358Z","title":"Olympiadbench: A challenging benchmark for promoting agi with olympiad-level bilingual multimodal scientific problems","venue":null,"work_id":"9c99616f-2e6a-4219-acc4-b0d9776ceb45","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.575056Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:b44f98a6bb7e3246239205f84ea1a28f216d1793a1c7e3ff0a05b2c506047ba8","observation_id":"6615949d-360f-4b61-aafd-d0fa82c3cc12","resolution":{"observed_at":"2026-08-07T06:01:50.071182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.060206Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":"2a74a4cd-d0f8-427f-8442-e1e4e770ed82","year":2021},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.578064Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:4e60270ee31232a5c8c1ae6ddd6b3cb3219ae3102088cd41a7096854de47bbd7","observation_id":"a6206ae8-5c3d-49b4-9454-3b9f7b7dfdd7","resolution":{"observed_at":"2026-08-07T06:01:50.063008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.051023Z","title":null,"venue":null,"work_id":"02908e40-9e95-475f-8d1a-497749e11f07","year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.580921Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:a45fccefa6e1b4f0dcb501777f38b9a200160ddfdd2a046cc49cdfc1b31495be","observation_id":"9304a6a1-960c-4815-8029-c7f5c411cc31","resolution":{"observed_at":"2026-08-07T06:01:50.054249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T06:01:49.583947Z","title":"Scaling laws for neural language models.arXiv preprint arXiv:2001.08361, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.583947Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:f1aabb0500c67ca03f9cfa74a8b9ddfd7ec25051056d05c81713154529ba75fe","observation_id":"58dafe04-cc7a-4e4f-9f17-aac6769e7b41","resolution":{"observed_at":"2026-08-07T06:01:49.583947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.041648Z","title":"Joshi, Hanna Moazam, Heather Miller, Matei Zaharia, and Christopher Potts","venue":null,"work_id":"0c6f90b4-789b-43f1-a4df-858e29c0ab2a","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.587128Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:0602dea2c4c7e791a031094aa2aadb7e25fb0a5f687ef7ddfb99d54a6d45264f","observation_id":"5d23a060-1f90-47c6-ae2a-39bdaf4805f3","resolution":{"observed_at":"2026-08-07T06:01:50.044666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T06:01:49.590032Z","title":"Adam: A method for stochastic optimization.arXiv preprint arXiv:1412.6980, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.590032Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:dbe1d6b15a30f6d3989a2b1acafa12cb12afaece636ee4f3fda6be4988a5e657","observation_id":"ca1cde79-0582-48a3-9987-ef2351bf5337","resolution":{"observed_at":"2026-08-07T06:01:49.590032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.593301Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.593301Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:024fc3a0a34d71aba0144f4348de43995d4f7008970273fb89fde3556db74c22","observation_id":"e2e395fa-293f-4a74-b642-2dc397fdb872","resolution":{"observed_at":"2026-08-07T06:01:49.593301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.04146","last_updated":"2017-10-23T16:45:03Z","snapshot_observed_at":"2026-08-02T16:52:38.363314Z","submitted_at":"2017-05-11T13:04:47Z","title":"Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.04146","snapshot_observed_at":"2026-08-07T06:01:49.596287Z","title":"Program induction by rationale generation: Learning to solve and explain algebraic word problems.arXiv preprint arXiv:1705.04146, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.596287Z"},"links":{"cited_paper":"/paper/1705.04146","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:622a645c42e9b34d17414ed7b4211cee07b57b74a00e13d745e93ba9eab58181","observation_id":"c5320723-4884-4098-a925-eb61e99e37b8","resolution":{"observed_at":"2026-08-07T06:01:49.596287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.024496Z","title":"De- ductive verification of chain-of-thought reasoning","venue":null,"work_id":"4df9b319-9ca4-4199-80de-c2fe816e96f8","year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.599966Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:739d970d2e3ab3e389a8b3718a5f047c3dcdbc72e362e9463fa38b0be1938e68","observation_id":"894aa066-6ce1-407a-8262-3fd0d77c2a05","resolution":{"observed_at":"2026-08-07T06:01:50.027446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.015518Z","title":"Augmenting math word problems via iter- ative question composing","venue":null,"work_id":"52d9213c-726b-4d03-9d98-1643d7a00c4f","year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.603100Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:b8aa95f354128f76c5f77792219ce5746ba273ddb9cb2be24a0eef9beb0426e1","observation_id":"845cded4-b15d-4a5f-9945-02bb648920de","resolution":{"observed_at":"2026-08-07T06:01:50.018575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09583","last_updated":"2025-06-04T08:58:56Z","snapshot_observed_at":"2026-08-02T06:48:43.121988Z","submitted_at":"2023-08-18T14:23:21Z","title":"WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09583","snapshot_observed_at":"2026-08-07T06:01:49.605966Z","title":"Wizardmath: Empowering mathematical reasoning for large language models via reinforced evol-instruct.arXiv preprint arXiv:2308.09583, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.605966Z"},"links":{"cited_paper":"/paper/2308.09583","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:d9dc203b1baad891faa814f84ad6827e5d9f3d336238b03dd93b28693f15a8fb","observation_id":"1d994272-1ae9-4e24-b792-01b45293f264","resolution":{"observed_at":"2026-08-07T06:01:49.605966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.006759Z","title":"Self-refine: Iterative refine- ment with self-feedback","venue":null,"work_id":"97c356ff-6d86-49d9-bb29-aa5f0535c490","year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.609272Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:7410e5b3dd4a6d5c22b6727050ca4a08b6ed19d33e202668a329eec36154b82c","observation_id":"d391c9a1-d796-49d8-b8f1-4b6dd3343939","resolution":{"observed_at":"2026-08-07T06:01:50.010218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.998189Z","title":"Mixed precision training","venue":null,"work_id":"c6ca3dcc-8856-438a-bee6-e8d1648710f9","year":2018},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.612198Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:4c53550575c8b24f2d436a61907f2f62932a51c774e6e5214cd474103d5f6d03","observation_id":"0e5fb33f-a412-4300-96f1-554ec0c7cda3","resolution":{"observed_at":"2026-08-07T06:01:50.001032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.990155Z","title":"Language model self-improvement by reinforcement learning contemplation","venue":null,"work_id":"708d23b4-8e4f-452b-b2ce-5911694f8a90","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.615160Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:7ba1a603dbc4a9e57897edf195feef60117fdb35cafc20d26ddf3c6a1f789df9","observation_id":"7977b957-b1e6-4d74-80d4-4eac8e9c6d09","resolution":{"observed_at":"2026-08-07T06:01:49.992891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16212","last_updated":"2025-06-16T05:58:00Z","snapshot_observed_at":"2026-08-07T16:48:57.884796Z","submitted_at":"2025-03-20T15:00:41Z","title":"MathFusion: Enhancing Mathematical Problem-solving of LLM through Instruction Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16212","snapshot_observed_at":"2026-08-07T06:01:49.618228Z","title":"Mathfusion: Enhancing mathematic problem-solving of llm through instruction fusion.arXiv preprint arXiv:2503.16212, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.618228Z"},"links":{"cited_paper":"/paper/2503.16212","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:5b02455d631276265f66d7eb21102cdc9bb2d1363481bd5a127497bd25820c05","observation_id":"04767874-cc53-40d4-8f29-3b2332b46b50","resolution":{"observed_at":"2026-08-07T06:01:49.618228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-08-09T14:52:01.161814Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-07T06:01:49.621442Z","title":"Scaling language models: Methods, analysis & insights from training gopher.arXiv preprint arXiv:2112.11446, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.621442Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:83450d484b1c41eeb8e4688b5388ab0606a703987a61ae55b511e325f14aa128","observation_id":"c9fc2a4a-e911-4326-bb45-84ff21f0a476","resolution":{"observed_at":"2026-08-07T06:01:49.621442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.624958Z","title":"Deepspeed: System optimizations enable training deep learning models with over 100 billion parameters","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.624958Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:677919b2d07ec06acb4f4f99ef5ef599f6a1b65ccb6b5d5f98ea5a685f7d8293","observation_id":"cd05c8d1-fc17-4466-a809-6e6af6f526ab","resolution":{"observed_at":"2026-08-07T06:01:49.624958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.627905Z","title":"Analysing mathematical reasoning abilities of neural models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.627905Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:87023b48b6e7879e49baf0e3495f52790333c9729240a1810745fa63e4fde4ed","observation_id":"22a82896-b587-4f09-8ad6-543654d08c92","resolution":{"observed_at":"2026-08-07T06:01:49.627905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.970424Z","title":"Rewarding progress: Scaling automated process verifiers for LLM reasoning","venue":null,"work_id":"cd4b61eb-026a-41b7-a4b4-348f7945b20c","year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.630721Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:812c0f1ec11dd8625ba50e66e2d475a823c554965723e391cf92a3c7aa0d1074","observation_id":"d9ed9ac6-d457-4101-959d-acc064a3f801","resolution":{"observed_at":"2026-08-07T06:01:49.973837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T06:01:49.633553Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open lan- guage models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.633553Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:22df5807142ee9a5fbdb8cd2e2962ba0ae09a12af6cbf0661f48fbc2297be673","observation_id":"74731a10-536c-431b-bafd-bb46b566c5ea","resolution":{"observed_at":"2026-08-07T06:01:49.633553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.962070Z","title":"Mathscale: Scaling instruction tuning for mathematical reasoning","venue":null,"work_id":"34a38962-71ba-4421-b30b-66714e2d78b2","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.636577Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:f8cbfe4d171c423fcac4dd2212fc31f2eca08ca87cc2b4a05da699fa85f42ebd","observation_id":"7b657d8b-325c-4634-a932-9fccc8102c8a","resolution":{"observed_at":"2026-08-07T06:01:49.964749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17565","last_updated":"2025-05-13T07:43:57Z","snapshot_observed_at":"2026-08-07T15:59:30.215146Z","submitted_at":"2025-04-24T13:57:53Z","title":"DeepDistill: Enhancing LLM Reasoning Capabilities via Large-Scale Difficulty-Graded Data Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17565","snapshot_observed_at":"2026-08-07T06:01:49.639408Z","title":"Deepdistill: Enhancing llm reasoning capabilities via large-scale difficulty-graded data training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.639408Z"},"links":{"cited_paper":"/paper/2504.17565","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:ed013b82631c17dc5e2782f8d84775360e5241c8ed9303396d86135c06d717d1","observation_id":"70a24f33-f89f-420e-a912-b3f76ef6311f","resolution":{"observed_at":"2026-08-07T06:01:49.639408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.953886Z","title":"DART-math: Difficulty-aware rejection tuning for mathematical problem-solving","venue":null,"work_id":"6f46233d-66d2-45a5-b646-95679860535b","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.642734Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:d95df9e016081049c82093680d8a952bb5097eaf7a8cff9377389bc995583b1b","observation_id":"6f9294c4-bb5f-4959-afeb-825ce813ab14","resolution":{"observed_at":"2026-08-07T06:01:49.956635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.945417Z","title":"Openmathinstruct-2: Accelerating AI for math with massive open-source instruction data","venue":null,"work_id":"642fb79a-8da5-40ae-b6e3-0961b16d5562","year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.645845Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:088194d35072edfab49ae5706d03de698dda7fecf8b0c518e51ed9fad2619dc2","observation_id":"b892089e-e129-442b-83d0-180c10c154bc","resolution":{"observed_at":"2026-08-07T06:01:49.948456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.937143Z","title":"Mathcoder: Seamless code integration in llms for enhanced mathemat- ical reasoning","venue":null,"work_id":"b54af121-bad9-494f-a4f9-80e91ce14ca8","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.648974Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:669f6a55189343df4bee81c04df565ddb45ebd3f4f8005f70c5ae76bde6ac2bd","observation_id":"45fbdd08-ef36-498b-8511-4bc76f5db7f7","resolution":{"observed_at":"2026-08-07T06:01:49.939948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.652040Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.652040Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:47fb794e368569861a41f1a5ccaf49980f5a33594577365f553149a76fda7f04","observation_id":"933337ac-cda6-4136-ade6-9c7294b793af","resolution":{"observed_at":"2026-08-07T06:01:49.652040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.923250Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"0ecdae15-f941-4496-86cc-f8ba3f44804f","year":2022},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.655028Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:cf5de892a7f6c4cf0c45f3260565c2448c9c5259ae2de069253e84d13ff927f7","observation_id":"ee371d35-76ef-4986-8abf-a571e1c8f312","resolution":{"observed_at":"2026-08-07T06:01:49.926208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00451","last_updated":"2024-06-17T22:11:49Z","snapshot_observed_at":"2026-08-10T23:49:19.260833Z","submitted_at":"2024-05-01T11:10:24Z","title":"Monte Carlo Tree Search Boosts Reasoning via Iterative Preference Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00451","snapshot_observed_at":"2026-08-07T06:01:49.657996Z","title":"Monte carlo tree search boosts reasoning via iterative preference learning.arXiv preprint arXiv:2405.00451, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.657996Z"},"links":{"cited_paper":"/paper/2405.00451","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:f9f505254ca3ac61608bc3c61d605f5465ec93ea466bfba9d049b5d3927696ab","observation_id":"3f1b2dee-12e0-4eea-ac87-090838360a58","resolution":{"observed_at":"2026-08-07T06:01:49.657996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-11T04:46:35.104351Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T06:01:49.661304Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.661304Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:5c4eb4e50cc42ef3968dd2084de9306e041bfc4d53e6d3a2aa306435a2321f5a","observation_id":"eb26364b-9673-4dc3-92d1-342ae56409e4","resolution":{"observed_at":"2026-08-07T06:01:49.661304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02391","last_updated":"2025-05-05T06:26:00Z","snapshot_observed_at":"2026-08-07T15:56:29.149996Z","submitted_at":"2025-05-05T06:26:00Z","title":"Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02391","snapshot_observed_at":"2026-08-07T06:01:49.664298Z","title":"Optimizing chain-of-thought reasoners via gradient variance minimization in rejection sampling and rl.arXiv preprint arXiv:2505.02391, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.664298Z"},"links":{"cited_paper":"/paper/2505.02391","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:aafd96a50f14291e45ded5a698aa12f6cf12ae98bd988492b10ae1ded7c74779","observation_id":"bccae710-a182-47cd-93e1-f582b97def4c","resolution":{"observed_at":"2026-08-07T06:01:49.664298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.667556Z","title":"Griffiths, Yuan Cao, and Karthik R Narasimhan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.667556Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:5712e0017e9344e2eda3b668c4b12bb4e6bdfc7cade73be69d040406f139ab80","observation_id":"7f6473ac-46ea-47f6-b125-57b7ea2d72c0","resolution":{"observed_at":"2026-08-07T06:01:49.667556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.670751Z","title":"Metamath: Bootstrap your own mathematical questions for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.670751Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:7ba12e8e7c659c4c9861bbaad17f5cee9bd3f30a45e3db5bf66ae9684e22f606","observation_id":"3f1b7163-dc08-4270-b641-0658e9727f5e","resolution":{"observed_at":"2026-08-07T06:01:49.670751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01825","last_updated":"2023-09-13T03:57:29Z","snapshot_observed_at":"2026-08-12T02:50:09.789901Z","submitted_at":"2023-08-03T15:34:01Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01825","snapshot_observed_at":"2026-08-07T06:01:49.674191Z","title":"Scaling relationship on learning mathematical reasoning with large language models.arXiv preprint arXiv:2308.01825, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.674191Z"},"links":{"cited_paper":"/paper/2308.01825","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:f4b2f0af0bca482bae1cc65e1de4943993da1e4b0d1f3ff301431f4a3813b501","observation_id":"d6c23084-484b-49cc-9614-de44279b59ca","resolution":{"observed_at":"2026-08-07T06:01:49.674191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.904200Z","title":"Optimizing generative ai by backpropagating language model feedback.Nature, 639:609– 616, 2025","venue":null,"work_id":"aba6eee5-d22b-4293-bc83-a22693ab397f","year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.677863Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:c973cb83943b84b8d9b359e1aeb7e72ee3441d61498537117edef7b38b5fa77a","observation_id":"eff1e131-cff3-42a4-a439-64d4d7de1691","resolution":{"observed_at":"2026-08-07T06:01:49.907121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.680835Z","title":"Rest-mcts*: Llm self-training via process reward guided tree search.Advances in Neural Information Processing Systems, 37:64735–64772, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.680835Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:1d32e85c9c6be9ac4240ab3fb3c81ac26aa4d4480a487fc8876c4a43f27bcf55","observation_id":"f8934e60-64aa-458e-b0d6-d235526a419b","resolution":{"observed_at":"2026-08-07T06:01:49.680835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.889337Z","title":"Generative verifiers: Reward modeling as next-token prediction","venue":null,"work_id":"f1ad7114-9a52-4d93-b469-3f5704ba2228","year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.684016Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:aab9fbfcf604ac86ab7b15be1c05130917eb9224a8ca3645bb40e8aeb2e55dec","observation_id":"1f45e870-0fa1-4943-972e-ba6306902764","resolution":{"observed_at":"2026-08-07T06:01:49.892757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.879918Z","title":"Chain of preference optimization: Improving chain-of-thought reasoning in LLMs","venue":null,"work_id":"0a5a2a2f-c95d-468e-afcb-13cfaf53927d","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.687276Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:a7027fff6df55166d8f3562ea863ef75e09109e94dc4eb5808019aef23eb2476","observation_id":"a4b74b54-490a-4d21-a8ad-362f80aeaa36","resolution":{"observed_at":"2026-08-07T06:01:49.882850Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.871234Z","title":"The computation sequence token length was fixed at 4096 to capture long range mathematical rea- soning","venue":null,"work_id":"4dbf027d-1310-4232-a34c-7b5e95adedfe","year":null},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.690658Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:ef1ad5b11dbd4ca4d68419ecef9e3363906d1ae073608097f29a2c62a5d5ebe2","observation_id":"80bb1ffd-0e50-4f9d-93f3-70b224317ae2","resolution":{"observed_at":"2026-08-07T06:01:49.874125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.860476Z","title":"Step 2:Use the given altitude length to solve forx","venue":null,"work_id":"d82a8d95-c56a-4921-ad95-2f19165b5616","year":null},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.694046Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:1ef5dcbcb521d840e4824a63d7db5e12bd9e280b42318a5ebbf70554a88f5cbb","observation_id":"2316e3fe-bec0-481d-90b0-f1d776bdce3a","resolution":{"observed_at":"2026-08-07T06:01:49.864918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 1 inbound Pith citation observation for arXiv:2506.06470."}