{"as_of":"2026-08-23T12:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2d4d4764d06a0d3c1832239b18d418a46fca7c64ee153fba710484b01ed832ba","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:27:36.415915Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-05T14:25:18.768204Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-05T14:31:09.389697Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"cited_work":{"arxiv_id":"2507.02726","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.02726","snapshot_observed_at":"2026-07-05T14:31:09.389697Z","title":"arXiv preprint arXiv:2507.02726 , year=","venue":"cs.AI","work_id":"76a240ce-3324-42e5-9a0d-67cc66564871","year":2025},"citing_paper":{"arxiv_id":"2602.24273","last_updated":"2026-05-14T16:23:55Z","snapshot_observed_at":"2026-08-15T04:03:37.203141Z","submitted_at":"2026-02-27T18:43:47Z","title":"A Minimal Agent for Automated Theorem Proving","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-15T18:44:35.600033Z"},"links":{"cited_paper":"/paper/2507.02726","citing_paper":"/paper/2602.24273"},"observation_digest":"sha256:78d603a86ca795e42c3046afe6541d1213f3b29b7248c0c60d2777d927a0b3c4","observation_id":"7d70182b-4a8d-4162-bc7b-480731730197","resolution":{"observed_at":"2026-05-15T18:46:29.382931Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"cited_work":{"arxiv_id":"2507.02726","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.02726","snapshot_observed_at":"2026-07-05T14:31:09.389697Z","title":"arXiv preprint arXiv:2507.02726 , year=","venue":"cs.AI","work_id":"76a240ce-3324-42e5-9a0d-67cc66564871","year":2025},"citing_paper":{"arxiv_id":"2604.18050","last_updated":"2026-06-06T08:37:26Z","snapshot_observed_at":"2026-08-02T16:57:39.622042Z","submitted_at":"2026-04-20T10:18:08Z","title":"The Topological Dual of a Dataset: A Logic-to-Topology Encoding for AlphaGeometry-Style Data","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T04:58:24.217267Z"},"links":{"cited_paper":"/paper/2507.02726","citing_paper":"/paper/2604.18050"},"observation_digest":"sha256:266e9238d2fb20fcf2bce467ff8c90163254bc9e370cd2cd0d809e604a96f3c8","observation_id":"9001b22b-e930-415b-b191-d1c6e746abe8","resolution":{"observed_at":"2026-05-10T10:29:25.468040Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"cited_work":{"arxiv_id":"2507.02726","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.02726","snapshot_observed_at":"2026-07-05T14:31:09.389697Z","title":"arXiv preprint arXiv:2507.02726 , year=","venue":"cs.AI","work_id":"76a240ce-3324-42e5-9a0d-67cc66564871","year":2025},"citing_paper":{"arxiv_id":"2604.18050","last_updated":"2026-06-06T08:37:26Z","snapshot_observed_at":"2026-08-02T16:57:39.622042Z","submitted_at":"2026-04-20T10:18:08Z","title":"The Topological Dual of a Dataset: A Logic-to-Topology Encoding for AlphaGeometry-Style Data","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-05T14:25:18.768204Z"},"links":{"cited_paper":"/paper/2507.02726","citing_paper":"/paper/2604.18050"},"observation_digest":"sha256:a596bbb427c50306ea3572e3fe60902401ccbbc36b08047662340cc3a43ec6ca","observation_id":"d273f458-4cd0-478e-87cc-88f3e207e99d","resolution":{"observed_at":"2026-07-05T14:31:09.391679Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"cited_work":{"arxiv_id":"2507.02726","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.02726","snapshot_observed_at":"2026-07-05T14:31:09.389697Z","title":"arXiv preprint arXiv:2507.02726 , year=","venue":"cs.AI","work_id":"76a240ce-3324-42e5-9a0d-67cc66564871","year":2025},"citing_paper":{"arxiv_id":"2605.17283","last_updated":"2026-05-17T06:39:05Z","snapshot_observed_at":"2026-08-14T15:06:22.101894Z","submitted_at":"2026-05-17T06:39:05Z","title":"OProver: A Unified Framework for Agentic Formal Theorem Proving","version":1},"reference_index":150,"source":"arxiv_source","source_observed_at":"2026-05-20T14:43:46.517807Z"},"links":{"cited_paper":"/paper/2507.02726","citing_paper":"/paper/2605.17283"},"observation_digest":"sha256:3d9c18c4eb5380899aaf02199471154e9d43f9dd9d06fc2e241d416d9c5b3789","observation_id":"df9c1c13-f963-45c1-a752-d32902e9cf8d","resolution":{"observed_at":"2026-05-20T14:48:23.454979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"cited_work":{"arxiv_id":"2507.02726","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.02726","snapshot_observed_at":"2026-07-05T14:31:09.389697Z","title":"arXiv preprint arXiv:2507.02726 , year=","venue":"cs.AI","work_id":"76a240ce-3324-42e5-9a0d-67cc66564871","year":2025},"citing_paper":{"arxiv_id":"2606.28747","last_updated":"2026-06-27T05:55:18Z","snapshot_observed_at":"2026-08-07T22:15:06.040926Z","submitted_at":"2026-06-27T05:55:18Z","title":"Self-Supervised Theorem Discovery in a Formal Axiomatic System","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-30T09:47:55.163143Z"},"links":{"cited_paper":"/paper/2507.02726","citing_paper":"/paper/2606.28747"},"observation_digest":"sha256:ad6ed5be9fc9cf31c2ac6409ae6045dca39b0873e5603a3c770702afae0ab878","observation_id":"441a997f-85dc-4aa2-97b8-14013a157973","resolution":{"observed_at":"2026-06-30T09:54:35.177736Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.02726/citation-record","integrity":"/paper/2507.02726/integrity","json":"/paper/2507.02726/citation-record.json","paper":"/paper/2507.02726"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.691202Z","title":"Ai achieves silver-medal standard solving international mathematical olympiad problems","venue":null,"work_id":"947f2f92-6a18-4cbb-be3c-752a72d3d390","year":2024},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.326602Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:7b4099a7f5fd432eb15d7e5190b4eb65e42be28ed59fe16e49fe03dc93624fd8","observation_id":"2bd8eb8f-3cd7-44ed-a6c9-5d5e7ac0022d","resolution":{"observed_at":"2026-08-06T20:27:36.694751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.680605Z","title":"Pantograph: A machine-to-machine interaction interface for advanced theorem proving, high level reasoning, and data extraction in lean 4","venue":null,"work_id":"92fe06f3-b80e-4fd9-9f15-7d8cbf7fbe68","year":2025},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.330073Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:208e52502d90e51c1c40ad880ca9d790118924c99dee4ba1018653af933a8a7f","observation_id":"bd3da9a8-6ad0-4de9-be66-590a77fa5830","resolution":{"observed_at":"2026-08-06T20:27:36.683747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.671688Z","title":"Stp: Self-play llm theorem provers with iterative conjecturing and proving","venue":null,"work_id":"6de774ba-bdd6-48ae-aed2-5221fc5d2467","year":2025},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.333498Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:5389344499d2d8055de2114d1a8b28445db8959a1e2b9cc15421ae43a4569c00","observation_id":"8eaa53c7-ef2c-454b-819d-97a3a0fba06f","resolution":{"observed_at":"2026-08-06T20:27:36.674787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.663026Z","title":"Abel: Sample efficient online reinforcement learning for neural theorem proving","venue":null,"work_id":"08bd7c7e-b20b-4c16-a4ce-a784d3db5c1a","year":2024},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.336463Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:c53985a026dfd50553f2d63c6e5aeb624bf5fa4b97f228760f842c34f23e4f76","observation_id":"22a587c4-3ffa-4dba-ba34-70d832d594c5","resolution":{"observed_at":"2026-08-06T20:27:36.665885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.06203","last_updated":"2022-03-16T02:59:37Z","snapshot_observed_at":"2026-08-16T18:46:08.345300Z","submitted_at":"2021-02-11T18:59:24Z","title":"Proof Artifact Co-training for Theorem Proving with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.06203","snapshot_observed_at":"2026-08-06T20:27:36.339984Z","title":"Ayers, and Stanislas Polu","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.339984Z"},"links":{"cited_paper":"/paper/2102.06203","citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:c0d1f5da382b1c4a0036b897b45c8e1f62ca7d7e7855041f29fbca8e93673d16","observation_id":"a30fabea-82b8-48c7-a6e9-eff7dcc3820e","resolution":{"observed_at":"2026-08-06T20:27:36.339984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11491","last_updated":"2022-05-23T17:49:55Z","snapshot_observed_at":"2026-08-20T09:56:04.987380Z","submitted_at":"2022-05-23T17:49:55Z","title":"HyperTree Proof Search for Neural Theorem Proving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11491","snapshot_observed_at":"2026-08-06T20:27:36.343420Z","title":"Hypertree proof search for neural theorem proving, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.343420Z"},"links":{"cited_paper":"/paper/2205.11491","citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:78734717491f21db163897367e37705f8648bdc37d576568fef97631193eced0","observation_id":"fb33e8ba-773c-47db-8418-9bd70e94406c","resolution":{"observed_at":"2026-08-06T20:27:36.343420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07640","last_updated":"2025-04-19T13:53:05Z","snapshot_observed_at":"2026-08-19T20:10:21.442760Z","submitted_at":"2025-02-11T15:27:35Z","title":"Goedel-Prover: A Frontier Model for Open-Source Automated Theorem Proving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07640","snapshot_observed_at":"2026-08-06T20:27:36.346663Z","title":"Goedel-prover: A frontier model for open-source automated theorem proving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.346663Z"},"links":{"cited_paper":"/paper/2502.07640","citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:87f8f01682844e1bcdc53514d17516381e0dac3bfcded343c8ede943ba822cad","observation_id":"55b8ecd9-32db-4036-8b42-ccc84b0db863","resolution":{"observed_at":"2026-08-06T20:27:36.346663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08299","last_updated":"2022-09-02T10:46:40Z","snapshot_observed_at":"2026-08-16T17:27:02.445517Z","submitted_at":"2022-01-20T17:06:42Z","title":"Goal-Conditioned Reinforcement Learning: Problems and Solutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08299","snapshot_observed_at":"2026-08-06T20:27:36.349835Z","title":"Goal-conditioned reinforcement learning: Problems and solutions, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.349835Z"},"links":{"cited_paper":"/paper/2201.08299","citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:a8694713239e412428763427e3de1ecbbc528b530f18c749a768ca5f66fbd383","observation_id":"4ea218e3-983c-4711-9946-e715fba6e942","resolution":{"observed_at":"2026-08-06T20:27:36.349835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21801","last_updated":"2025-07-18T08:20:23Z","snapshot_observed_at":"2026-08-02T11:46:58.603316Z","submitted_at":"2025-04-30T16:57:48Z","title":"DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21801","snapshot_observed_at":"2026-08-06T20:27:36.352988Z","title":"Deepseek-prover-v2: Advancing formal mathematical reasoning via reinforcement learning for subgoal decomposition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.352988Z"},"links":{"cited_paper":"/paper/2504.21801","citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:829cfe538f7dfbc51683437f52ef8da322929555a2eae4b3743a8a34c0bb4063","observation_id":"572c0208-3837-4f7e-aad1-a7642b453eb2","resolution":{"observed_at":"2026-08-06T20:27:36.352988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.654752Z","title":"Universal value function approximators","venue":null,"work_id":"79547293-35a5-4a55-a140-1a22f3297bb1","year":2015},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.356184Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:f7807792927bef608bef8ce0851302413416cda23a072d88519bad0451dff3bf","observation_id":"a2dd3b74-f7ec-4676-971e-69d295307e2a","resolution":{"observed_at":"2026-08-06T20:27:36.657688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.645365Z","title":"Putnambench: A multilingual competition-mathematics benchmark for formal theorem-proving","venue":null,"work_id":"ccc10cb8-2bec-4d35-ab73-ebf5e821b849","year":2024},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.358949Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:7436dba1dd50a1ac51ba5743579fd248e58f90b1c714e3c184c24f0d7ab59f2e","observation_id":"9e4e93a7-174e-457e-8bff-f8ca34ed22a1","resolution":{"observed_at":"2026-08-06T20:27:36.648711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.362235Z","title":"DT -solver: Automated theorem proving with dynamic-tree sampling guided by proof-level value function","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.362235Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:12460bf953fca76f8f74f6136cd8f4f240d71afcca5f2d426719a5e1ec1a2a4d","observation_id":"d1fc058e-e898-426b-ad3d-db875306398e","resolution":{"observed_at":"2026-08-06T20:27:36.362235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11354","last_updated":"2025-04-15T16:23:44Z","snapshot_observed_at":"2026-08-15T23:16:36.618851Z","submitted_at":"2025-04-15T16:23:44Z","title":"Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11354","snapshot_observed_at":"2026-08-06T20:27:36.365305Z","title":"Kimina-prover preview: Towards large formal reasoning models with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.365305Z"},"links":{"cited_paper":"/paper/2504.11354","citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:f3b1071baddcb879236a4ad09a3727019831cec97efde8b0d2284646f6bfef45","observation_id":"41520fe1-8200-4818-aef7-355eb345bf0e","resolution":{"observed_at":"2026-08-06T20:27:36.365305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.368325Z","title":"Internlm2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.368325Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:187f37a14a88f126ee68974a507b2ce75829e97e21975e848948fb94cd699999","observation_id":"8dbed5ea-0ad6-4afc-b9be-474366ebb5e5","resolution":{"observed_at":"2026-08-06T20:27:36.368325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08152","last_updated":"2024-08-15T13:40:03Z","snapshot_observed_at":"2026-08-20T13:55:12.013069Z","submitted_at":"2024-08-15T13:40:03Z","title":"DeepSeek-Prover-V1.5: Harnessing Proof Assistant Feedback for Reinforcement Learning and Monte-Carlo Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08152","snapshot_observed_at":"2026-08-06T20:27:36.371313Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.371313Z"},"links":{"cited_paper":"/paper/2408.08152","citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:d5b6f16ed9bbb3c3e14283f1eba66e3978b348e45236eeccf62b1f5025905803","observation_id":"17991571-cd2a-444c-a667-59dc82f1846b","resolution":{"observed_at":"2026-08-06T20:27:36.371313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.628133Z","title":"Leandojo: Theorem proving with retrieval-augmented language models","venue":null,"work_id":"28e5140f-b60a-404e-a19b-ee4a112e41b9","year":2023},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.374248Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:575814b2e6a4214088af2ae597873eea1b29e91e98fe65c4fa89b467a80fdc1c","observation_id":"99d6e7d4-7396-4fd7-8c40-883cc4203798","resolution":{"observed_at":"2026-08-06T20:27:36.632939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.377150Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.377150Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:9bfa7d5b3183857e3a11395db7c60b30aedf5d08a7fce44657831983f71979ba","observation_id":"4ccbc70b-d683-4ea5-ab50-eaaa06c49a01","resolution":{"observed_at":"2026-08-06T20:27:36.377150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.383318Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.383318Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:2bf5ce152373af74c99cb9656522aa93370a553d4d0d061a6c0cb24237f3e4a3","observation_id":"d471af5f-8d18-4026-9334-8ed1f3bed302","resolution":{"observed_at":"2026-08-06T20:27:36.383318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.396136Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.396136Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:556b267aec9070b31a6d6d7e712a61c4ab2496bd1b250324c3fcba87fbeaeb19","observation_id":"38a0cc23-8a04-4251-829b-606e8be1f261","resolution":{"observed_at":"2026-08-06T20:27:36.396136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:27:36.415915Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T20:27:36.415915Z"},"links":{"citing_paper":"/paper/2507.02726"},"observation_digest":"sha256:61813a02801030243f0b9900b08c13509a89806eb994e54e30f7dc6141ff3ead","observation_id":"cb5a89df-68ba-4134-90b8-2480a7370719","resolution":{"observed_at":"2026-08-06T20:27:36.415915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.02726","last_updated":"2025-07-03T15:41:38Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-15T19:48:21.667277Z","submitted_at":"2025-07-03T15:41:38Z","title":"Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 5 inbound Pith citation observations for arXiv:2507.02726."}