{"as_of":"2026-08-10T14:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e9a1433ecb200d196dbfb680e9c7ca483346d9a42433536e713fb8f90d002c7f","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:26:52.816300Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.19903/citation-record","integrity":"/paper/2508.19903/integrity","json":"/paper/2508.19903/citation-record.json","paper":"/paper/2508.19903"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-05T15:26:52.728328Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.728328Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:151d0cd340af3062c8e3b6bdd588f739955464721dce165ff109d32a1a259537","observation_id":"b7087924-0729-49ef-a3bf-8212c0530578","resolution":{"observed_at":"2026-08-05T15:26:52.728328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-08-10T11:04:44.168282Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-05T15:26:52.732798Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.732798Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:5036edba3cf1bd38ce69a0e97e6300bf1d311e7658741eada6fa24834bf83cb4","observation_id":"c3056f3b-8e04-49fa-acf3-cd2deee7a1bb","resolution":{"observed_at":"2026-08-05T15:26:52.732798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T15:26:52.736892Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.736892Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:adc1ce20701fe38ad3ea57b00f68be00da5291dbb204c6e925ccf3c1a931bac7","observation_id":"40436993-5ee3-41b0-853b-afd8acce21bd","resolution":{"observed_at":"2026-08-05T15:26:52.736892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:53.087674Z","title":"Fabbri, Wojciech Kryscinski, Semih Yavuz, Ye Liu, Xi Victoria Lin, Shafiq Joty, Yingbo Zhou, Caiming Xiong, Rex Ying, Arman Cohan, and Dragomir Radev","venue":null,"work_id":"041567ea-27da-4f7b-a170-d11d7c243b66","year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.741046Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:52c968dd418eff7657c4756928b0a1863a82844f2fd4e17c9d49f3af4d4b13c0","observation_id":"053b84d0-a2eb-4912-94f8-93da3eb77f65","resolution":{"observed_at":"2026-08-05T15:26:53.093107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.744805Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.744805Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:3f4f84cde88a429a000453ddea297cc8472f659e4ad5068780479b7eb35296b2","observation_id":"1bacd92f-c50c-450c-9dc0-4e92fdbacd45","resolution":{"observed_at":"2026-08-05T15:26:52.744805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-05T15:26:52.748712Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.748712Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:fe09890adfbeaa77a16a73cf098224e478c7f03fc307d1705e8a935d5db4309b","observation_id":"67afe112-f1a2-483e-a564-6376c518eee4","resolution":{"observed_at":"2026-08-05T15:26:52.748712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-05T15:26:52.752965Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.752965Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:e201e066a42d38cf7692a92b9587e8f42aed37e92cd183597b39ea3a3ca1d12d","observation_id":"39104c15-7d71-463c-9d02-66be191b2844","resolution":{"observed_at":"2026-08-05T15:26:52.752965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00284","last_updated":"2024-07-11T05:06:25Z","snapshot_observed_at":"2026-07-06T18:23:39.931536Z","submitted_at":"2024-06-01T03:29:56Z","title":"A Closer Look at Logical Reasoning with LLMs: The Choice of Tool Matters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00284","snapshot_observed_at":"2026-08-05T15:26:52.757698Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.757698Z"},"links":{"cited_paper":"/paper/2406.00284","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:54d1b778f5fbde3fffa028bc21ba9d24e025facb01ea042a9804fad7669b005f","observation_id":"37c1c938-6b4f-4244-8901-a6f83db59867","resolution":{"observed_at":"2026-08-05T15:26:52.757698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04625","last_updated":"2025-03-07T18:13:22Z","snapshot_observed_at":"2026-08-07T17:24:07.321477Z","submitted_at":"2025-03-06T17:11:51Z","title":"START: Self-taught Reasoner with Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04625","snapshot_observed_at":"2026-08-05T15:26:52.761394Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.761394Z"},"links":{"cited_paper":"/paper/2503.04625","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:040e10595e8aa3ea23e544ddf541fcabbce362326a01746b7acebc2a20639258","observation_id":"b0b8ccb1-fad0-4035-9e9e-14ad90696a83","resolution":{"observed_at":"2026-08-05T15:26:52.761394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.765584Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.765584Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:ddb79253e74836f8f295d43290ac850362f91e613290d4ae1ffb730a722bc639","observation_id":"f402c349-5e83-409c-ac41-8e1fd96a9448","resolution":{"observed_at":"2026-08-05T15:26:52.765584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.768976Z","title":"Zhang, Armando Solar - Lezama, Joshua B","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.768976Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:2d2236d324d82285b2f70d5fbef9b7e313fa182a70234fd4d79cb9ca30634231","observation_id":"cdac56e0-1ff4-4ba7-8015-06b60a9d04a6","resolution":{"observed_at":"2026-08-05T15:26:52.768976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.773005Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.773005Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:8c37776612ec3a32531663385b9e9aa369a4f2a4878d3d10adf0e35517552972","observation_id":"e003ffb1-1682-48dd-8b3c-14cc9c6be5f2","resolution":{"observed_at":"2026-08-05T15:26:52.773005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06563","last_updated":"2025-03-02T16:38:28Z","snapshot_observed_at":"2026-08-10T06:25:45.649847Z","submitted_at":"2025-02-10T15:31:54Z","title":"Large Language Models Meet Symbolic Provers for Logical Reasoning Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06563","snapshot_observed_at":"2026-08-05T15:26:52.776686Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.776686Z"},"links":{"cited_paper":"/paper/2502.06563","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:bf413593f9653332ff9e8c89112a33462aa724a4f7ee59707233399a52b80ebb","observation_id":"ce3e289a-d08b-4d3d-8d3f-f37884a6f23d","resolution":{"observed_at":"2026-08-05T15:26:52.776686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-05T15:26:52.780303Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.780303Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:cfb33652a41e3cd58e7ef5836d66b5b1e7613793adf6cf0b3c2787460c10e86b","observation_id":"1031d570-310b-4458-acf8-86cdf3ff0bc1","resolution":{"observed_at":"2026-08-05T15:26:52.780303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16461","last_updated":"2024-09-24T21:24:07Z","snapshot_observed_at":"2026-08-10T06:35:59.957232Z","submitted_at":"2024-09-24T21:24:07Z","title":"Strategies for Improving NL-to-FOL Translation with LLMs: Data Generation, Incremental Fine-Tuning, and Verification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16461","snapshot_observed_at":"2026-08-05T15:26:52.784006Z","title":"Buntine, and Ehsan Shareghi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.784006Z"},"links":{"cited_paper":"/paper/2409.16461","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:51cbe3e78e2be621214edec66b7e611d624a2ff4a160a813a61077e061672319","observation_id":"364cffa8-0ada-4631-844e-ad15dfe307d4","resolution":{"observed_at":"2026-08-05T15:26:52.784006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-05T15:26:52.787792Z","title":"Francis Song, Noah Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.787792Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:e16c43fd0842a7d3c97fe9a5b1632c540789cc750cb7aba97f3c868bd3d22b8e","observation_id":"b98684d4-f6b6-4466-a858-9772f8c2be91","resolution":{"observed_at":"2026-08-05T15:26:52.787792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.791295Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.791295Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:557925f3b3505276970f6cc682eb0865fa4658ac546ec32cf9912fb0e616af9b","observation_id":"353a5442-2b9c-4ae6-824e-3574bcc1efc0","resolution":{"observed_at":"2026-08-05T15:26:52.791295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.794880Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.794880Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:8eaf9297f323c8d1be6676f2379383037dee1bcdfacda7e80ab485af1ca15020","observation_id":"3920aab4-2a9c-41be-80ec-c2477fbf92bd","resolution":{"observed_at":"2026-08-05T15:26:52.794880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T15:26:52.798870Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.798870Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:d48d06cabf125cdccbc5c92c3758be30916ef841e2c77c4abb8fa9cd5d035b42","observation_id":"972dbe22-2d59-4f61-8e6b-b249ffb6da92","resolution":{"observed_at":"2026-08-05T15:26:52.798870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:53.050062Z","title":null,"venue":null,"work_id":"7fb04ade-2d3d-4791-be42-391bdb16f08a","year":2023},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.802869Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:f6147a858db74b0fe55507aa49084c1bb2c3f9e6da72712453692e1b25bcbe20","observation_id":"ea7e3f4b-556a-409a-88cd-7619fc670b71","resolution":{"observed_at":"2026-08-05T15:26:53.054868Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07301","last_updated":"2025-06-05T16:34:24Z","snapshot_observed_at":"2026-08-03T11:11:25.359494Z","submitted_at":"2025-01-13T13:10:16Z","title":"The Lessons of Developing Process Reward Models in Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07301","snapshot_observed_at":"2026-08-05T15:26:52.807424Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.807424Z"},"links":{"cited_paper":"/paper/2501.07301","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:08ce1ff880863700f1d1b858462bf7b9622a5e559545dbcc78b8c1bbf8f74379","observation_id":"eb39a6cd-e778-4ec0-b42a-f65491dbd8f1","resolution":{"observed_at":"2026-08-05T15:26:52.807424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.811818Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.811818Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:cff783a42cbbca79cfbd95ba77555d44ca4a4a7170fa16df876b4c669fc79d40","observation_id":"6bc34e11-3105-44b6-a9cb-79f84048d237","resolution":{"observed_at":"2026-08-05T15:26:52.811818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.816300Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.816300Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:d8b74a96fc9db69b5386aa5e2c8e22a13cd86a9a8754da12d1ce721f58abb1a5","observation_id":"ba7e1584-de20-4324-abec-2241b515dea5","resolution":{"observed_at":"2026-08-05T15:26:52.816300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2508.19903."}