{"as_of":"2026-08-10T04:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bbfadb7964cddaf49f349543fc240999454b6391a6f96341c5d7d87810ef344f","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:50:10.807992Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:59:52.207597Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T16:41:18.221645Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23474","snapshot_observed_at":"2026-08-06T00:59:52.207597Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04088","last_updated":"2025-08-07T03:52:48Z","snapshot_observed_at":"2026-08-08T12:10:28.774282Z","submitted_at":"2025-08-06T05:10:29Z","title":"GM-PRM: A Generative Multimodal Process Reward Model for Multimodal Mathematical Reasoning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T00:59:52.207597Z"},"links":{"cited_paper":"/paper/2505.23474","citing_paper":"/paper/2508.04088"},"observation_digest":"sha256:50e8ee6f8b9d5a0b19781436c822427029c8ba48d146381e14d23345dda758f7","observation_id":"81dc8df2-5b22-4612-b7e8-22b815cfec68","resolution":{"observed_at":"2026-08-06T00:59:52.207597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"cited_work":{"arxiv_id":"2505.23474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23474","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mirage: Evaluating and explaining inductive reasoning process in language models","venue":null,"work_id":"8dbbcb81-9129-43fc-8824-86f87feb0f66","year":null},"citing_paper":{"arxiv_id":"2605.01203","last_updated":"2026-05-07T08:32:54Z","snapshot_observed_at":"2026-08-03T02:31:09.487114Z","submitted_at":"2026-05-02T02:41:48Z","title":"GR-Ben: A General Reasoning Benchmark for Evaluating Process Reward Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-09T15:21:37.643840Z"},"links":{"cited_paper":"/paper/2505.23474","citing_paper":"/paper/2605.01203"},"observation_digest":"sha256:917096c5e27bc74af2a01c5cfeb424a76dd870b05f0ed898594d285c502e4787","observation_id":"0e9f884f-1360-4c01-b5e3-68594264d8f2","resolution":{"observed_at":"2026-05-11T16:41:18.225765Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23474/citation-record","integrity":"/paper/2505.23474/integrity","json":"/paper/2505.23474/citation-record.json","paper":"/paper/2505.23474"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:14.354618Z","title":null,"venue":null,"work_id":"97fd3f82-2dde-49e7-95a9-810db03cec2f","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:09.175876Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:b39ca3f81bfbede35635d93fd757df5d72ce32426f80d659f5265afb758bbe62","observation_id":"65c4786c-3b68-4fcd-93af-1cd184a00d94","resolution":{"observed_at":"2026-08-07T12:50:14.441363Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:14.654349Z","title":"InThe Twelfth Inter- national Conference on Learning Representations","venue":null,"work_id":"25aaaa5f-e6ab-408b-9983-4be14184046d","year":2024},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:08.768550Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:65bbbb81835b31d3ed0a60943f6aff6e503a174a028cc17134b6b0acdda00bce","observation_id":"69966aaf-3219-46e1-a51c-fe9d40112df8","resolution":{"observed_at":"2026-08-07T12:50:14.715022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:13.693943Z","title":null,"venue":null,"work_id":"1d15f896-8bd7-485b-a497-fcb13786da65","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:09.569400Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:77050c048a186fafb84bde2490aed8d97c090c475b946a1440541b2f4aa5f8d9","observation_id":"debae775-08c2-4cf3-beb7-7ec6fb39f339","resolution":{"observed_at":"2026-08-07T12:50:13.777412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:14.526005Z","title":"InProceed- ings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Pa- pers), pages 9426–9439, Bangkok, Thailand","venue":null,"work_id":"8f7bdf14-8651-4fb8-85a2-80d145ee653b","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:08.941643Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:08ed196dfc831c31acc204379619a73f1a09b460670175d60090a7f6f2da86d8","observation_id":"3ab783d7-8ef5-404c-b362-a4a8a47622e4","resolution":{"observed_at":"2026-08-07T12:50:14.583605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:13.240891Z","title":"Indexing starts at 1","venue":null,"work_id":"f88a3281-191d-47f0-a646-d8518b8f340e","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:09.767110Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:711d099575b1ff72ba9a7fb6b8f3e758685800e8edd68e3715ff0b1985f77f53","observation_id":"40c3ce94-a84a-4b61-b594-446c0c70629a","resolution":{"observed_at":"2026-08-07T12:50:13.380097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13957","last_updated":"2026-05-16T17:37:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:56:03Z","title":"Supervising the search process produces reliable and generalizable information-seeking agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13957","snapshot_observed_at":"2026-08-07T12:50:09.106021Z","title":"validity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:09.106021Z"},"links":{"cited_paper":"/paper/2502.13957","citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:f7c78d72effcbb9ba3d49058a8400ec4e9146514aa285bb7c079c186b2caa8cb","observation_id":"4021477b-1333-456b-969e-a4b42a36b545","resolution":{"observed_at":"2026-08-07T12:50:09.106021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:12.761050Z","title":"### Notes:","venue":null,"work_id":"f1ab38a6-48b1-4778-9299-5a98749b113e","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:09.960011Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:9619a051a39d55cf8b47864557cf3005abc7abe5d1f038629f2efec189a155e5","observation_id":"e2dd1eb7-acc9-4c0d-be80-e9297b2e4da9","resolution":{"observed_at":"2026-08-07T12:50:12.886392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:14.215513Z","title":"original_question","venue":null,"work_id":"ad5ae9d3-5215-4ae3-b6dc-062181d6d70b","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:09.291652Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:1cf0ea84767af93c002ec486dc61a6e07a6fac272d24f733c810cee64f4418d4","observation_id":"5d91dc26-6331-47d3-b241-82ab93cae470","resolution":{"observed_at":"2026-08-07T12:50:14.296585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:14.031137Z","title":null,"venue":null,"work_id":"5912eb96-1bcd-42d7-9023-f5fd4cb9faf7","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:09.393013Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:73d0433cdedd9d43ab8357f2fff8619932e89ccf020e76092ae4682390425bfe","observation_id":"fa47e5fb-34b6-48e1-9ea1-339532d70720","resolution":{"observed_at":"2026-08-07T12:50:14.132812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:13.854022Z","title":"If the problem remains the same, you can copy the original question","venue":null,"work_id":"028c30bd-3c55-4df9-abdc-8baba48ae68e","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:09.476109Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:3d1575aebed246bd4bcbc5748c0335c4fd32c976b07f554f123360335b30d3e0","observation_id":"9b4971a8-4438-4f62-80c0-df8393b6f0f0","resolution":{"observed_at":"2026-08-07T12:50:13.923988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:13.482947Z","title":null,"venue":null,"work_id":"bc249ab1-b311-4d89-be2b-1119833ac6f1","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:09.667828Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:2a1b420381375f27b0f5a86bb1ffa1a2e44c649316221b7ea1b1303e3871a840","observation_id":"db53a570-1a83-4e36-afeb-2ab1bb21f970","resolution":{"observed_at":"2026-08-07T12:50:13.576094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:13.027116Z","title":"These should also be part of modified_steps","venue":null,"work_id":"cb7b0196-a15e-4bb9-96ca-afd985ef6d9f","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:09.858242Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:d6d0669cb0adaaace608c8e1d5ef8d71f7c65fe199c4e687a7eec29277a2f8ec","observation_id":"7ba3fccf-f189-47fe-8cc1-a6e5884bb620","resolution":{"observed_at":"2026-08-07T12:50:13.141065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:12.482234Z","title":null,"venue":null,"work_id":"6d27dca7-1dd0-4e9f-b022-9623561658fd","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:10.058687Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:88f12fd7bb380472d0e79c8938b70386ef0a52121b38d6779bd7b044694e3984","observation_id":"fb9f2da4-eca7-4701-aa85-7f98c5f728fe","resolution":{"observed_at":"2026-08-07T12:50:12.607611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:12.280824Z","title":"Do not use Unicode symbols such as \\u2248 or \\u00f7","venue":null,"work_id":"50e77324-ec56-4be4-bff6-dda96a5ec006","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:10.133166Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:69fd77b30cd9201e01fafac901253108de664956d4dce04df86e17c2eed77050","observation_id":"88be8039-4ba9-422a-807a-7abc4368aff3","resolution":{"observed_at":"2026-08-07T12:50:12.360478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:12.105235Z","title":null,"venue":null,"work_id":"3b2cb8a3-358f-4d36-944e-1cb587535848","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:10.260765Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:4b762539215eac22bb11bc08e3aec8351e8c97268ba4aaf88fd295dab9947965","observation_id":"5b8eea3e-5576-4fe4-a2c4-5bb24622ca76","resolution":{"observed_at":"2026-08-07T12:50:12.206434Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.905481Z","title":null,"venue":null,"work_id":"a2d8b26e-2075-413c-9d1d-9f611e487f66","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:10.432134Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:1d3c8375aedb61bcf72cac39126f9d3e6e6029480a4692580c096521196311e7","observation_id":"dfdea850-752d-41fc-8d2e-6992c5e8bf79","resolution":{"observed_at":"2026-08-07T12:50:12.017457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.666093Z","title":"But if the question is modified, ensure that the steps is judged based on the modified question","venue":null,"work_id":"5cd823ff-2d70-4cfd-8b75-56de818ae877","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:10.522728Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:697abb655afe5c03387e63de24afd9a842ccff27b5a8a478e240e91aac20a9b9","observation_id":"b355d66d-5299-44d4-a3ec-1ae37e4dc346","resolution":{"observed_at":"2026-08-07T12:50:11.807734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.446435Z","title":"Table 9: Output format prompt for test case construction","venue":null,"work_id":"65e5c748-f098-4c93-91de-ffdb60cf2559","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:10.658171Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:6603dcce0867c6948e830bf7fb38c5b96a879f06108458ced3035b6d6e909d9b","observation_id":"63bd17e5-7734-46dc-b130-c3c741a84bf0","resolution":{"observed_at":"2026-08-07T12:50:11.553098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.231361Z","title":null,"venue":null,"work_id":"7a6ba088-8dc1-464b-84c4-cc6ae2433860","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:10.730570Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:eac991b47c56ef89cae9316c939f5e1ae0cbeab528a004289ec90609c840dbba","observation_id":"f0927acf-098b-43f5-b738-346817278076","resolution":{"observed_at":"2026-08-07T12:50:11.337673Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.025444Z","title":"Please put your final answer (Yes or No) in \\boxed {}","venue":null,"work_id":"0ece6d94-4f0b-41d9-8c75-d8194a2d02f5","year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:10.807992Z"},"links":{"citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:608095b19337a635c7413c9efad32e4539f5c5b27cabc494ed81f3c9b9dd39cf","observation_id":"c6cec271-4979-4794-9cbc-1044141aebf3","resolution":{"observed_at":"2026-08-07T12:50:11.123360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-07T12:50:09.019196Z","title":"Guangzhi Xiong, Qiao Jin, Xiao Wang, Yin Fang, Haolin Liu, Yifan Yang, Fangyuan Chen, Zhixing Song, Dengyu Wang, Minjia Zhang, and 1 others","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:09.019196Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:2d38690f754911cc1868dae60699b44c61e4dfb457e3ff2b6ed91b253c2caf37","observation_id":"c90f73b7-2efe-4de7-9eb4-8952e2acb6f0","resolution":{"observed_at":"2026-08-07T12:50:09.019196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11791","last_updated":"2024-08-21T17:24:15Z","snapshot_observed_at":"2026-08-10T02:45:59.371931Z","submitted_at":"2024-08-21T17:24:15Z","title":"Critique-out-Loud Reward Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11791","snapshot_observed_at":"2026-08-07T12:50:08.718847Z","title":"Hritik Bansal, Arian Hosseini, Rishabh Agarwal, Vinh Q","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:08.718847Z"},"links":{"cited_paper":"/paper/2408.11791","citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:dd554edb4a7e0cf45dbf1bbfa5b4ab96888ae0dccefc14258de89924239fce2e","observation_id":"61de2095-0d17-444c-88a6-01b3badfa06f","resolution":{"observed_at":"2026-08-07T12:50:08.718847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23803","last_updated":"2025-04-08T12:36:08Z","snapshot_observed_at":"2026-08-09T05:03:28.563523Z","submitted_at":"2025-03-31T07:31:32Z","title":"Thinking Longer, Not Larger: Enhancing Software Engineering Agents via Scaling Test-Time Compute","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23803","snapshot_observed_at":"2026-08-07T12:50:08.867038Z","title":"Philipp Mondorf and Barbara Plank","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:08.867038Z"},"links":{"cited_paper":"/paper/2503.23803","citing_paper":"/paper/2505.23474"},"observation_digest":"sha256:5682dc4564d983ebcf80a23e8e03ff9520fad40f9b00dfa6a733e9f6df38b2fb","observation_id":"0fa02318-d3cb-4b80-bb73-a0c1e8dac829","resolution":{"observed_at":"2026-08-07T12:50:08.867038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23474","last_updated":"2025-05-29T14:26:53Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T05:03:49.587023Z","submitted_at":"2025-05-29T14:26:53Z","title":"Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":11,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 2 inbound Pith citation observations for arXiv:2505.23474."}