{"as_of":"2026-08-09T11:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6f2c6a3b78ebf3f0b17f5e283030e13eaa0f24a77b59a021324aef1e25046b91","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:44:59.510685Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:17:28.616993Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T15:20:18.946831Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04592","snapshot_observed_at":"2026-08-06T22:17:28.616993Z","title":"Safe: Enhancing mathematical reasoning in large language models via retrospective step-aware formal verification, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22005","last_updated":"2025-06-27T08:17:18Z","snapshot_observed_at":"2026-08-06T22:10:53.633909Z","submitted_at":"2025-06-27T08:17:18Z","title":"LeanConjecturer: Automatic Generation of Mathematical Conjectures for Theorem Proving","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T22:17:28.616993Z"},"links":{"cited_paper":"/paper/2506.04592","citing_paper":"/paper/2506.22005"},"observation_digest":"sha256:115430b58b6011b357c4bfed53140bfce595accad6e4a6322a0902b81a3b040e","observation_id":"2b38c5b5-ca51-4071-9234-64a65a46db49","resolution":{"observed_at":"2026-08-06T22:17:28.616993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"cited_work":{"arxiv_id":"2506.04592","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04592","snapshot_observed_at":"2026-08-06T15:20:18.946831Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","venue":"cs.CL","work_id":"63acbaa4-b53c-4a19-b5aa-ad99e4cde664","year":2025},"citing_paper":{"arxiv_id":"2507.16331","last_updated":"2026-07-03T09:17:03Z","snapshot_observed_at":"2026-08-07T04:15:41.914807Z","submitted_at":"2025-07-22T08:13:01Z","title":"Re:Form -- Reducing Human Annotations in Scalable Formal Software Verification with RL in LLMs: A Preliminary Study on Dafny","version":4},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T15:20:14.514001Z"},"links":{"cited_paper":"/paper/2506.04592","citing_paper":"/paper/2507.16331"},"observation_digest":"sha256:59d2a30c1ed49826e872ef0ce6e8aa9bd513562eb3f649f6309439d9d44b2332","observation_id":"44aa9e5a-8ce3-4ece-b7bd-f98cf55671ea","resolution":{"observed_at":"2026-08-06T15:20:18.953748Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04592/citation-record","integrity":"/paper/2506.04592/integrity","json":"/paper/2506.04592/citation-record.json","paper":"/paper/2506.04592"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.00157","last_updated":"2024-09-16T19:20:59Z","snapshot_observed_at":"2026-08-03T23:38:38.676420Z","submitted_at":"2024-01-31T20:26:32Z","title":"Large Language Models for Mathematical Reasoning: Progresses and Challenges","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00157","snapshot_observed_at":"2026-08-07T10:44:59.314638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.314638Z"},"links":{"cited_paper":"/paper/2402.00157","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:4adc1257d243289bc7e410fd4c0d72253891cc8b53d87751ff94376e64541a2f","observation_id":"0a8b4406-5832-45e1-8897-10e849757da2","resolution":{"observed_at":"2026-08-07T10:44:59.314638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.964261Z","title":null,"venue":null,"work_id":"23f8e401-d361-4fe7-a35d-1f17a3107b83","year":2021},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.318138Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:a6607777e9388d604b21e70f045b843414b26c38dc7e265b1d0158a75325c236","observation_id":"4ff635bf-b878-4082-823d-39da13267101","resolution":{"observed_at":"2026-08-07T10:44:59.967125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.956082Z","title":null,"venue":null,"work_id":"e1640f89-c0f5-4e23-b440-9873fa3dc43c","year":2021},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.322532Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:29156a6eccebf064090f3b95ea806d6a8cfa1a892c9998865a52b783232fa283","observation_id":"c26706cc-b685-4334-8756-2889c066eeac","resolution":{"observed_at":"2026-08-07T10:44:59.958644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.325494Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.325494Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:b1999ca0869483c360765b922007565dd9ddbbdaee16f96e1bf42304a0dd0a62","observation_id":"497770ac-70fd-4c6f-b22b-c258db0c496f","resolution":{"observed_at":"2026-08-07T10:44:59.325494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T10:44:59.328997Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.328997Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:b58ef926e8f53adfbf77c189fe1e27efc86857bd002557d80e85197f02085703","observation_id":"b3665208-52fa-4820-92d2-8b40814d69eb","resolution":{"observed_at":"2026-08-07T10:44:59.328997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T10:44:59.332576Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.332576Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:2a4aac981d90aa5a2713c14a9fbf63a6dd5b5d61b33c5f09fc39f6bc3f3ff1eb","observation_id":"7bc8e8dd-c668-4b57-87ca-4c9f2983465a","resolution":{"observed_at":"2026-08-07T10:44:59.332576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.944847Z","title":null,"venue":null,"work_id":"cd5acbc0-1feb-40f3-af51-4b602a3d7ed4","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.335833Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:bfc01a212228e9fd3a3a2f56d08e0ab7a85fb07a378887b8009c739ffbf9b473","observation_id":"f38c60a5-3741-49ad-a78c-0c371af6bbcd","resolution":{"observed_at":"2026-08-07T10:44:59.947476Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.936710Z","title":null,"venue":null,"work_id":"1f4e1250-b8a8-4418-912f-6e7ae9c156a9","year":2022},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.338852Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:d564c1aee6a300a6008e4b80e8c96e941d07e8270e271fd1cdf7e783acdc3fbe","observation_id":"4df0577f-4001-468a-b95d-8cb8457a93d4","resolution":{"observed_at":"2026-08-07T10:44:59.939689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.341710Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.341710Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:a0506858ca0c5f1ad8d11b2ad876f3a06921efd46ea612f2f6c711890c46f4ce","observation_id":"ed325208-c5ff-458d-96c5-1494a38d43a2","resolution":{"observed_at":"2026-08-07T10:44:59.341710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.924860Z","title":null,"venue":null,"work_id":"9fea3f99-c064-4d1f-9d1a-3f22b60353f4","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.344582Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:1e2df9fb65af3d29c2da60190cf5cac516e9629318a6664c4abde769aecaaf38","observation_id":"87723558-d3f0-4d3a-aa07-54c58eae4073","resolution":{"observed_at":"2026-08-07T10:44:59.928164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.347562Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.347562Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:ca24cba8e8dcb211f074fd52f0ac9208b1b8a7264c0cc7f4983cefe71db1ddc0","observation_id":"39ff0bcf-742b-43bb-91b2-f4294e0a6195","resolution":{"observed_at":"2026-08-07T10:44:59.347562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.913242Z","title":null,"venue":null,"work_id":"ac379cf7-3e02-42eb-9fe8-040276671cb8","year":1997},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.350611Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:86215ef2f23761bb8da97448889aa2f556958e2733b8fa5b8619311ec963b30d","observation_id":"ca38ed18-8ed7-46b5-ac4c-99993534495d","resolution":{"observed_at":"2026-08-07T10:44:59.915939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.353232Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.353232Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:0f248502038ea11ee5494dc11de12945ec318c984aac7597fa9b98ea7bd8bded","observation_id":"80b99761-2363-40cc-8748-1e7f8a120661","resolution":{"observed_at":"2026-08-07T10:44:59.353232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.902510Z","title":null,"venue":null,"work_id":"6ea2c965-17a5-4b3a-b356-befecbb09a16","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.355900Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:1bc4a084278931110615b0add922aa9cfd01ceaab6e0429a6797353867f20171","observation_id":"ed0ae6dc-8e83-49e2-9431-de8b1e60725f","resolution":{"observed_at":"2026-08-07T10:44:59.905116Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T10:44:59.358492Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.358492Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:35a0f8105127d6f88616f100dc43009c3b0a55056a03984cb9b473ec2c003474","observation_id":"f4700c45-62f0-4c33-a081-5873e1b4ab45","resolution":{"observed_at":"2026-08-07T10:44:59.358492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.894378Z","title":null,"venue":null,"work_id":"3ecf9e2b-a9bc-4824-8619-019c4e3fbfb3","year":2022},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.361274Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:9a9db9ac1a09cd293cd7da4ead101b47319aa70d9cf12bdd023344b0fd539186","observation_id":"81485b53-4e8b-4c58-9bd6-58a5cc4fa8a2","resolution":{"observed_at":"2026-08-07T10:44:59.897276Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.886892Z","title":null,"venue":null,"work_id":"5cee0f2d-8738-4642-a2cd-256dd01c9bbb","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.363852Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:fe3b61b0d034030ba095d9baac15c518f88e21d1fc56c8ca8ff97ebf5dff6762","observation_id":"59386955-86c9-4bc4-bbc1-45b74d453371","resolution":{"observed_at":"2026-08-07T10:44:59.890093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.366523Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.366523Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:b55c96588559759015818b1be69547989dc9c57779f4686d4f29eeae66552f12","observation_id":"4a9d1346-d436-4a62-86b2-424fcf092b1f","resolution":{"observed_at":"2026-08-07T10:44:59.366523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.874219Z","title":null,"venue":null,"work_id":"1b48250f-1ae1-4c3e-871a-5c421aa97781","year":2020},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.369350Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:ff7f1df65ad735cb03d50e28746345abeda249186a69084c3a9551cf0361fd07","observation_id":"2cb400b4-8036-43ca-a2ea-2611bf5d6388","resolution":{"observed_at":"2026-08-07T10:44:59.877589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.372876Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.372876Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:e5385b4fe9bbb9eaebe1c7eebbcde03de563e9fcf1b2b3bd32e0b915b8303dab","observation_id":"5717639a-b226-448f-af52-38c1bcc5855b","resolution":{"observed_at":"2026-08-07T10:44:59.372876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.862698Z","title":null,"venue":null,"work_id":"a5de2e3b-c8d5-4009-bbf3-6893f0bb3091","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.375796Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:b31e86442d510b1ac8175ab09def335dfc86e58c8897a49a098f50a81d01a307","observation_id":"0435f491-9514-4b92-bdcd-52633e0415b5","resolution":{"observed_at":"2026-08-07T10:44:59.865476Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13787","last_updated":"2024-06-08T16:40:12Z","snapshot_observed_at":"2026-08-02T18:11:57.036767Z","submitted_at":"2024-03-20T17:49:54Z","title":"RewardBench: Evaluating Reward Models for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13787","snapshot_observed_at":"2026-08-07T10:44:59.378386Z","title":"Smith, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.378386Z"},"links":{"cited_paper":"/paper/2403.13787","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:3fb6c8870bb9777c1fd69ea767f85b53437c9f5da0fc6039e3632fceab02a1f3","observation_id":"96f48841-4829-40d3-bdba-7726951f6802","resolution":{"observed_at":"2026-08-07T10:44:59.378386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.854593Z","title":null,"venue":null,"work_id":"ef4c44c3-64e6-4c82-b078-4bd3e45745ae","year":2022},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.381405Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:fb1d82c281b42691217d3a2e39fa991a10a56bda4a26d7322103a8227e2731f6","observation_id":"3ea1986f-e7d7-4531-b341-cbf7ca3fdef4","resolution":{"observed_at":"2026-08-07T10:44:59.858080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00599","last_updated":"2024-03-31T08:10:50Z","snapshot_observed_at":"2026-08-08T13:09:21.316120Z","submitted_at":"2024-03-31T08:10:50Z","title":"EvoCodeBench: An Evolving Code Generation Benchmark Aligned with Real-World Code Repositories","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00599","snapshot_observed_at":"2026-08-07T10:44:59.384125Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.384125Z"},"links":{"cited_paper":"/paper/2404.00599","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:3ee8f956cda730931bbe0b340d45c84caff1d2ef8f307e2129426e7a5326501b","observation_id":"38b8e995-9922-44d7-9064-ba4401ed6059","resolution":{"observed_at":"2026-08-07T10:44:59.384125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.387846Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.387846Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:1fe27bdb164396cbca90b83a5bc5cad4e24ec05434f9839dfaebc3c264470209","observation_id":"fb43529e-c24f-49f8-8dd5-9f0a1e47bab7","resolution":{"observed_at":"2026-08-07T10:44:59.387846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04295","last_updated":"2023-12-05T08:38:01Z","snapshot_observed_at":"2026-08-07T23:35:18.737859Z","submitted_at":"2023-09-08T12:34:28Z","title":"FIMO: A Challenge Formal Dataset for Automated Theorem Proving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04295","snapshot_observed_at":"2026-08-07T10:44:59.390584Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.390584Z"},"links":{"cited_paper":"/paper/2309.04295","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:5270b75ff950936e1896763ded8657df60f8a1279b0d2b8def631d780224c910","observation_id":"026ff056-7a23-492a-836d-a5406c650fee","resolution":{"observed_at":"2026-08-07T10:44:59.390584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-08-07T05:53:12.643515Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18451","snapshot_observed_at":"2026-08-07T10:44:59.393457Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.393457Z"},"links":{"cited_paper":"/paper/2410.18451","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:691bdb91c447deee403bb240be48668bf860b1e7a79c54a4e9a420080d15cbd2","observation_id":"6193df7e-5dc7-4567-90a4-ff73a47eb869","resolution":{"observed_at":"2026-08-07T10:44:59.393457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01940","last_updated":"2024-10-14T03:46:00Z","snapshot_observed_at":"2026-08-05T18:55:10.658942Z","submitted_at":"2024-06-04T03:48:08Z","title":"Process-Driven Autoformalization in Lean 4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01940","snapshot_observed_at":"2026-08-07T10:44:59.396198Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.396198Z"},"links":{"cited_paper":"/paper/2406.01940","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:b51d01c1872609bf9532f22b04240cfcfceb2c10f25a7f74b948d2deac85a424","observation_id":"168df49c-4963-4de0-9ca2-46f2bacc2e9d","resolution":{"observed_at":"2026-08-07T10:44:59.396198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.399512Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.399512Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:df3bfac9ea723833c78ec8642348ff1c3b46c8bc77764026eb8ab8d6a895260e","observation_id":"961f0443-416f-4425-92d8-b51cf3dd2027","resolution":{"observed_at":"2026-08-07T10:44:59.399512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.09336","last_updated":"2019-12-16T20:37:52Z","snapshot_observed_at":"2026-07-06T08:31:00.030545Z","submitted_at":"2019-10-21T13:08:24Z","title":"The Lean mathematical library","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.09336","snapshot_observed_at":"2026-08-07T10:44:59.402345Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.402345Z"},"links":{"cited_paper":"/paper/1910.09336","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:f009bb44a364535c8e75a2f37872786d0cfaf76788ab72b5031cc04476a12941","observation_id":"df9bded4-17a9-478c-969b-f7b2d77c37bb","resolution":{"observed_at":"2026-08-07T10:44:59.402345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.405311Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.405311Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:fc0681c84ca706db51d1575553cfaa675b4329fbc9224238a66ad91185a9657f","observation_id":"0101a69b-0713-480e-b43d-0ae6dd539cf6","resolution":{"observed_at":"2026-08-07T10:44:59.405311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.839837Z","title":null,"venue":null,"work_id":"a0fe4d0f-b16f-42f2-90bd-9ff87ed98fde","year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.407975Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:ec6b19ffe536c3a76bf5e7afb7b4c038c1c7b87dde2744710650ec3438c19f0d","observation_id":"a5511e95-4098-49ec-90d0-271f5e5c273b","resolution":{"observed_at":"2026-08-07T10:44:59.842585Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.832300Z","title":null,"venue":null,"work_id":"4c849a84-1f85-4051-9c8c-f25be14c51ad","year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.410896Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:d724d09cbc65f4047cdc9155d3d7a1e7a146539859917b7e87f87bb60c56c3b4","observation_id":"ddb8de31-193a-4def-9166-1e14bbfd540c","resolution":{"observed_at":"2026-08-07T10:44:59.835296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.824654Z","title":null,"venue":null,"work_id":"37ae90fc-ebce-4f6b-9244-6ea6ebb4fe52","year":2022},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.413763Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:5533b23da019e0f68a438b6eb6008b715b588868731293f50d8f39f74b174931","observation_id":"938a2745-6525-4ab7-be01-3f64e617620f","resolution":{"observed_at":"2026-08-07T10:44:59.827195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03393","last_updated":"2020-09-07T19:50:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T19:50:10Z","title":"Generative Language Modeling for Automated Theorem Proving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03393","snapshot_observed_at":"2026-08-07T10:44:59.417804Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.417804Z"},"links":{"cited_paper":"/paper/2009.03393","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:2a405301cff94350d2e439341f04698388ac44c09e86ea20e29f4df2cefab83d","observation_id":"813c056d-6353-49bf-8115-256699197efa","resolution":{"observed_at":"2026-08-07T10:44:59.417804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-07T10:44:59.420494Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.420494Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:f26c9055b45a0ca94bb70162354f861f83b80c34a8b312a8fd2f2dbdf729a1b9","observation_id":"f6e26455-bf57-4a9c-baf8-9fe4999d157d","resolution":{"observed_at":"2026-08-07T10:44:59.420494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.817241Z","title":null,"venue":null,"work_id":"a78ac7f6-df22-428b-af07-cbcecc036438","year":2022},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.423051Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:2d4cfff0a5bb0d8144ab1af3070f078c8bb00349288d350ef432a51d6c298dbe","observation_id":"4e3de15b-d59b-4b99-83ba-ca9bc7ad5a00","resolution":{"observed_at":"2026-08-07T10:44:59.820122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.810033Z","title":null,"venue":null,"work_id":"30f7fbf3-1773-4444-9188-a4b46ff4125c","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.425505Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:da24a9181a00d56e272023bf93f02edbd7cb8d8427d1c809c6bf222bfe29aa1e","observation_id":"fbb76c3b-acac-4d4a-b03c-18e5a547bc59","resolution":{"observed_at":"2026-08-07T10:44:59.812590Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T10:44:59.428476Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.428476Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:1d39943bb8473ff5d9f04758b34944ac963834d0f0c937387a41188c522f62a5","observation_id":"215def12-0c2f-4eae-a8b0-ec0e9144abf2","resolution":{"observed_at":"2026-08-07T10:44:59.428476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.findings-emnlp.195","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.543280Z","title":null,"venue":null,"work_id":"3992c0b7-f124-46f4-bf51-146a48e8438c","year":2021},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.431213Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:bad8860f6bf4bc2af0b6582f18ca3c42010e6438ac67b2122d6f3ae9ddbe6032","observation_id":"ce194bc3-da9b-4379-8ce0-ed78990b6f72","resolution":{"observed_at":"2026-08-07T10:44:59.547381Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.802681Z","title":null,"venue":null,"work_id":"255808b3-0d63-47c1-af62-274a632c0460","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.433959Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:6b9b5c0a6302c73a9ef5b12f5d35804f557dd0f981d0e9736619c5e48192fde0","observation_id":"08a113e9-518e-444d-8ae3-9e1817b1ae8b","resolution":{"observed_at":"2026-08-07T10:44:59.805639Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.795790Z","title":null,"venue":null,"work_id":"eeadb995-58c5-4257-849a-3f4317f3a8a6","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.436651Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:fa203245da7234d07e5f97e9f4a00e6ac3b878355faf5a818f587c231b0cc75e","observation_id":"c40e29e1-26e5-47b1-8ab9-34158c2c48ef","resolution":{"observed_at":"2026-08-07T10:44:59.798289Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.788030Z","title":null,"venue":null,"work_id":"77d178c9-165e-4e75-807e-968fee47bdee","year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.440156Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:a3aeda952d4a7be7097525fc6d792659e01f8a934481cde3606160cf20cbc0ac","observation_id":"ee564e06-07ce-43a8-a95c-c3870aad75cb","resolution":{"observed_at":"2026-08-07T10:44:59.790571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.442685Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.442685Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:361a917f7306c6e76720a9db8dc0fab2001bab22a9c00087265d9d9708904dcb","observation_id":"1065ed31-53de-4fb0-8668-4b06dc655174","resolution":{"observed_at":"2026-08-07T10:44:59.442685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.780190Z","title":null,"venue":null,"work_id":"0e6ef8cd-10e0-4bfd-b1e1-fa452e620eda","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.445486Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:400cd1bd1b5be649bd5ca4db622cf0bdb49e30f74238c5f4c6ea72cd55532ef1","observation_id":"a87bf1d8-4e0b-48c5-8295-fcd5a172eec4","resolution":{"observed_at":"2026-08-07T10:44:59.782908Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.448037Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.448037Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:671f4ade8dd7abaaeb35d30f7a21f11291450f4939a305d676d81ea276cb98b2","observation_id":"87674b87-b5dd-42ef-b8dc-140112621262","resolution":{"observed_at":"2026-08-07T10:44:59.448037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10635","last_updated":"2024-06-28T08:24:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-20T07:01:57Z","title":"SciBench: Evaluating College-Level Scientific Problem-Solving Abilities of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10635","snapshot_observed_at":"2026-08-07T10:44:59.450839Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.450839Z"},"links":{"cited_paper":"/paper/2307.10635","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:233525f6f460c19fd7a00e2030f4d45e223a138dec88a7a59145da07716f2052","observation_id":"bf21d658-604d-4752-af9e-01bf920e9d7d","resolution":{"observed_at":"2026-08-07T10:44:59.450839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.453738Z","title":"Chi, Quoc V Le, and Denny Zhou","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.453738Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:47426c9f79a0f21f4c26f9989c25c65cb297df5568f6065440fae8458448acdb","observation_id":"f64dfd52-1a97-4a55-a69d-89c30c73eec2","resolution":{"observed_at":"2026-08-07T10:44:59.453738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.768460Z","title":null,"venue":null,"work_id":"f2da9838-ff42-4483-80b2-cd0c9c9d97b7","year":2022},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.456378Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:20a6330a84cd5ffb19daab0c5c97af21369576363e44a75f4804a5bbf027a7b7","observation_id":"c6d941dd-0837-4bcb-8a3d-a9f192f22956","resolution":{"observed_at":"2026-08-07T10:44:59.771006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14333","last_updated":"2024-05-23T09:03:42Z","snapshot_observed_at":"2026-07-06T18:18:25.746022Z","submitted_at":"2024-05-23T09:03:42Z","title":"DeepSeek-Prover: Advancing Theorem Proving in LLMs through Large-Scale Synthetic Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14333","snapshot_observed_at":"2026-08-07T10:44:59.459139Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.459139Z"},"links":{"cited_paper":"/paper/2405.14333","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:5fd640d18432fdf4d2f2dc32fc1bd18a20a5fbd91943fdf58dce0bc4d61f39bd","observation_id":"684c83d8-729a-41f3-89c1-e44ebaebea77","resolution":{"observed_at":"2026-08-07T10:44:59.459139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.761410Z","title":null,"venue":null,"work_id":"9a24defd-9e41-4193-972f-c9a8c4112f74","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.463401Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:9ef7984b24c39c2990e208db1e0d807372fbe189f1267af9d8461ac686e7e8f7","observation_id":"caa98479-512a-418f-8c4e-74924e71f9cf","resolution":{"observed_at":"2026-08-07T10:44:59.764145Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.753960Z","title":null,"venue":null,"work_id":"8f5fd378-b336-48a8-99a0-f24c9968aff6","year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.466077Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:c4486cc20dc0aae4ce005cdf6698405aa8f82999699e7c01e3b31e651cdd46bd","observation_id":"c3280eb4-68f2-4eed-a229-0980d1d7d322","resolution":{"observed_at":"2026-08-07T10:44:59.757003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.468639Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.468639Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:2da57e94b3395556a8a5fe287c146acfddc3e90bc4efba350aaeade235c4fcc2","observation_id":"3c5875da-165a-47b0-b879-fd5c1cd983ad","resolution":{"observed_at":"2026-08-07T10:44:59.468639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10528","last_updated":"2025-05-19T03:59:29Z","snapshot_observed_at":"2026-08-05T20:37:15.940003Z","submitted_at":"2024-02-16T09:29:50Z","title":"Can We Verify Step by Step for Incorrect Answer Detection?","version":4},"cited_work":{"arxiv_id":"2402.10528","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10528","snapshot_observed_at":"2026-08-07T10:44:59.617022Z","title":"Can We Verify Step by Step for Incorrect Answer Detection?","venue":"cs.CL","work_id":"029c0037-3cbb-455c-a8cf-332f07c2aa42","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.471059Z"},"links":{"cited_paper":"/paper/2402.10528","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:5652fbdf30f4ed4d618172d80b77b67396b7a5a5d765169267083b2efe23dfea","observation_id":"71f9c518-aba2-4af0-9c69-70e41899d8f0","resolution":{"observed_at":"2026-08-07T10:44:59.620047Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14804","last_updated":"2025-02-26T02:21:40Z","snapshot_observed_at":"2026-07-06T18:18:47.640933Z","submitted_at":"2024-05-23T17:13:50Z","title":"Can LLMs Solve longer Math Word Problems Better?","version":4},"cited_work":{"arxiv_id":"2405.14804","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.14804","snapshot_observed_at":"2026-08-07T10:44:59.607033Z","title":"Can LLMs Solve longer Math Word Problems Better?","venue":"cs.CL","work_id":"987f6cf0-dde3-4e57-9680-1631b0b347ff","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.473658Z"},"links":{"cited_paper":"/paper/2405.14804","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:385f1f3f47ea77f33980e4e6922916ca46754fece8e18a3051ee71f020cdeab1","observation_id":"1ee74c80-f7ec-4123-a69f-08d92a139756","resolution":{"observed_at":"2026-08-07T10:44:59.609963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13766","last_updated":"2025-02-25T08:15:43Z","snapshot_observed_at":"2026-07-06T20:25:03.950783Z","submitted_at":"2025-01-23T15:46:43Z","title":"UGMathBench: A Diverse and Dynamic Benchmark for Undergraduate-Level Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13766","snapshot_observed_at":"2026-08-07T10:44:59.476120Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.476120Z"},"links":{"cited_paper":"/paper/2501.13766","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:4d6232b7126823e3b97e71d13cffe9ed6906afcbc59b2abec36301922f96c772","observation_id":"2d14513f-748d-4736-b5d6-42ef87186ab8","resolution":{"observed_at":"2026-08-07T10:44:59.476120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01524","last_updated":"2025-06-28T04:34:18Z","snapshot_observed_at":"2026-07-06T19:09:27.758765Z","submitted_at":"2024-09-03T01:40:21Z","title":"S^3cMath: Spontaneous Step-level Self-correction Makes Large Language Models Better Mathematical Reasoners","version":3},"cited_work":{"arxiv_id":"2409.01524","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.01524","snapshot_observed_at":"2026-08-07T10:44:59.589269Z","title":"S^3cMath: Spontaneous Step-level Self-correction Makes Large Language Models Better Mathematical Reasoners","venue":"cs.CL","work_id":"1a76dcd5-6670-44da-aced-f305b79a6507","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.478740Z"},"links":{"cited_paper":"/paper/2409.01524","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:965e3b39a59aa995364d56e19f59c70a1b42a202f5d6f789efc1dcd821c7c133","observation_id":"a0f3c176-fe1f-4350-a9e6-7ca808dd995d","resolution":{"observed_at":"2026-08-07T10:44:59.593313Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.742895Z","title":null,"venue":null,"work_id":"7568cea3-7e87-4566-b3ad-c6a87b2119c8","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.481389Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:0cdc0c3bf6ef6ca8f6ab204d14ec5e0d5b582e2136b8ba7afe125036cf5fd14d","observation_id":"47bce112-3f26-45ee-9d5b-9e50b4c4754d","resolution":{"observed_at":"2026-08-07T10:44:59.745624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16075","last_updated":"2024-12-20T17:19:24Z","snapshot_observed_at":"2026-08-08T19:38:30.741786Z","submitted_at":"2024-12-20T17:19:24Z","title":"Formal Mathematical Reasoning: A New Frontier in AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16075","snapshot_observed_at":"2026-08-07T10:44:59.483870Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.483870Z"},"links":{"cited_paper":"/paper/2412.16075","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:fc19fbeaf7b3185f836c40696238dd4168c60a42d5271f1b3a92eb82ce5a900e","observation_id":"868daa88-127e-4bf0-bd83-83800ec58daa","resolution":{"observed_at":"2026-08-07T10:44:59.483870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.735974Z","title":null,"venue":null,"work_id":"0cd362ce-15d0-4fcc-8068-16e6f5ce1fd9","year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.486479Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:b0b1f33300174efbe90b8c24498f99d8c07a463c675c1b00cfe7773722d3ddb9","observation_id":"0fcec193-ce17-428e-8d42-99ac63171109","resolution":{"observed_at":"2026-08-07T10:44:59.738544Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03847","last_updated":"2025-06-18T16:07:47Z","snapshot_observed_at":"2026-08-07T23:35:20.471377Z","submitted_at":"2024-06-06T08:25:43Z","title":"Lean Workbook: A large-scale Lean problem set formalized from natural language math problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03847","snapshot_observed_at":"2026-08-07T10:44:59.489003Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.489003Z"},"links":{"cited_paper":"/paper/2406.03847","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:25a3164211fe81f16d1f020b68f3c7c2b42aeb09c8ad365e680310381ce480ec","observation_id":"b5b0d599-69e5-47f2-9495-7836b841ec13","resolution":{"observed_at":"2026-08-07T10:44:59.489003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06332","last_updated":"2024-05-24T07:09:21Z","snapshot_observed_at":"2026-08-06T07:58:05.717753Z","submitted_at":"2024-02-09T11:22:08Z","title":"InternLM-Math: Open Math Large Language Models Toward Verifiable Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06332","snapshot_observed_at":"2026-08-07T10:44:59.491464Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.491464Z"},"links":{"cited_paper":"/paper/2402.06332","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:d86924140d01b423416522e11a0f649a568c9d8dec93cf80a376e735fe2954ae","observation_id":"7320371f-1ce9-4e52-bbd3-073523d26039","resolution":{"observed_at":"2026-08-07T10:44:59.491464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-02T15:00:50.388422Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-07T10:44:59.494004Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.494004Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:bea93298abe67e4a6786d24a3b6de085643ce7441f6b146a5830745ef20a6f95","observation_id":"a07f3824-ea3e-4f7b-abbc-eab215c1c427","resolution":{"observed_at":"2026-08-07T10:44:59.494004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.496588Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.496588Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:99c396a370550f68bf98d1ab3eb17bba7f60e8117824b697e19f3272efe160bb","observation_id":"2867b088-41da-4f0e-a4a4-4dc062b4c585","resolution":{"observed_at":"2026-08-07T10:44:59.496588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.725351Z","title":null,"venue":null,"work_id":"c198bf61-a7d0-4d3f-ad0f-aa80c611f97b","year":2021},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.499292Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:d2aee732764c55f861e83321f0931ada6f85d9ee0059bc35803b3060588d16e8","observation_id":"1fd2d262-7974-486b-9173-4e194f3bee24","resolution":{"observed_at":"2026-08-07T10:44:59.727780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.718176Z","title":null,"venue":null,"work_id":"20da57e4-65ce-42bc-9fc6-367b6966abad","year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.501836Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:66d35d6d51528c112678fafd4b83a75718b4ec54ff33e4b2737c5838c4cbf8ba","observation_id":"ddfadd51-50ab-474c-8081-eb27fbe4a990","resolution":{"observed_at":"2026-08-07T10:44:59.720850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15877","last_updated":"2025-04-01T08:36:44Z","snapshot_observed_at":"2026-07-31T19:00:59.311189Z","submitted_at":"2024-06-22T15:52:04Z","title":"BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15877","snapshot_observed_at":"2026-08-07T10:44:59.504652Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.504652Z"},"links":{"cited_paper":"/paper/2406.15877","citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:16428019ba69683ae5de0f08287ba422c83d0ec5e9d8ae191abfea8242294293","observation_id":"cafb388e-d148-480e-88de-e0e563730abd","resolution":{"observed_at":"2026-08-07T10:44:59.504652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.507565Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.507565Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:ca38271d7406172db9178831c2c4ee00889e49f47f86d87622e1bf83056286d6","observation_id":"337bf8a3-ef04-45c3-b269-90747aa3e08c","resolution":{"observed_at":"2026-08-07T10:44:59.507565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:59.510685Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:59.510685Z"},"links":{"citing_paper":"/paper/2506.04592"},"observation_digest":"sha256:f8c00b4f45493409aea1965fd3b22751d27748fb3c6d2ec081e7070f9e1d8d57","observation_id":"6279587b-880c-4ec6-aa59-5de5c9663cad","resolution":{"observed_at":"2026-08-07T10:44:59.510685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.04592","last_updated":"2025-06-05T03:16:08Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T04:20:47.756843Z","submitted_at":"2025-06-05T03:16:08Z","title":"Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":65,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 2 inbound Pith citation observations for arXiv:2506.04592."}