{"as_of":"2026-08-14T08:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2f0c3ea7d3bbfa5edb8de584cd269601699c9046f7c38ce2d437a36c37badc2a","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:18:41.054671Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T09:29:45.021656Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T09:30:48.177781Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":"2506.10903","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10903","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"emnlp-demos.44/","venue":null,"work_id":"ad6e111f-bbd5-4df7-b83d-8711bbd1e073","year":2025},"citing_paper":{"arxiv_id":"2601.23166","last_updated":"2026-05-07T11:23:05Z","snapshot_observed_at":"2026-08-13T04:32:38.850391Z","submitted_at":"2026-01-30T16:48:33Z","title":"Monotonic Reference-Free Refinement for Autoformalization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T09:29:45.021656Z"},"links":{"cited_paper":"/paper/2506.10903","citing_paper":"/paper/2601.23166"},"observation_digest":"sha256:1d6b2e9bd49592d15bf0718284b34b001c7941008f2268e8fbd85e6cf685a9c9","observation_id":"dc4654cd-50d5-40c0-9878-6cbf9d206818","resolution":{"observed_at":"2026-05-16T09:30:48.179885Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.10903/citation-record","integrity":"/paper/2506.10903/integrity","json":"/paper/2506.10903/citation-record.json","paper":"/paper/2506.10903"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:32.195737Z","title":"Draft, sketch, and prove: Guiding formal theorem provers with informal proofs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.195737Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:16f10bd7ee0c25f52adf7e93db7b28e6f1307c2e30bce16c2ee4055a6880e3e5","observation_id":"a816238d-e1ab-4c7f-adf7-5d6b99775fc0","resolution":{"observed_at":"2026-08-07T04:18:32.195737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:50.291420Z","title":"Ren, Junxiao Song, Zhihong Shao, Wanjia Zhao, Haocheng Wang, Bo Liu, Liyue Zhang, Xuan Lu, Qiushi Du, Wenjun Gao, Haowei Zhang, Qihao Zhu, Dejian Yang, Zhibin Gou, Z.F","venue":null,"work_id":"fe17ef1a-2c9a-4286-8e3b-1c667386668f","year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.275985Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:a69187c9c6fed51db2edfac31d9cdc0053a1eaa06f372be138bdb853ff1982f8","observation_id":"137b8a50-ca7c-482a-951d-c2fb60725cc0","resolution":{"observed_at":"2026-08-07T04:18:50.397037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07640","last_updated":"2025-04-19T13:53:05Z","snapshot_observed_at":"2026-08-08T12:00:22.357251Z","submitted_at":"2025-02-11T15:27:35Z","title":"Goedel-Prover: A Frontier Model for Open-Source Automated Theorem Proving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07640","snapshot_observed_at":"2026-08-07T04:18:32.420330Z","title":"Goedel-prover: A frontier model for open-source automated theorem proving, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.420330Z"},"links":{"cited_paper":"/paper/2502.07640","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:ea4414f27c0da9f90effd045c83c4619a0f62c7af1b0c269941e770eb5ef783f","observation_id":"91dfdb80-5796-4738-addf-3a8f02fb9094","resolution":{"observed_at":"2026-08-07T04:18:32.420330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:50.057100Z","title":"Improver: Agent-based auto- mated proof optimization","venue":null,"work_id":"e392d9fd-0fb2-44ff-8912-e30c2fbb91d8","year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.532344Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:b907697443bc089eb2992fb2bb072df966c468e371902be704d1150c17d55b7b","observation_id":"d272895d-4865-4805-93a2-6e13de144499","resolution":{"observed_at":"2026-08-07T04:18:50.191854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:49.801960Z","title":"Learning formal mathematics from intrinsic motivation","venue":null,"work_id":"009be48f-2030-427e-ac8d-767a5e33b1c9","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.672032Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:b001e5b2b5572c5c6618d8283cfcf276c3b00b5b5a44625a28f19446962aea6e","observation_id":"75d131e4-b583-4ee6-a264-8d4735dd8f7a","resolution":{"observed_at":"2026-08-07T04:18:49.950599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02735","last_updated":"2025-05-05T15:37:00Z","snapshot_observed_at":"2026-08-07T23:36:07.412083Z","submitted_at":"2025-05-05T15:37:00Z","title":"FormalMATH: Benchmarking Formal Mathematical Reasoning of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02735","snapshot_observed_at":"2026-08-07T04:18:32.811609Z","title":"Formalmath: Benchmarking formal mathematical reasoning of large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.811609Z"},"links":{"cited_paper":"/paper/2505.02735","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:34b86beadc939a50ebb7939deb1703410122c5bb151d4a49eb5c50ee2b2c1c84","observation_id":"35677c87-0245-4d30-b063-71530db8b180","resolution":{"observed_at":"2026-08-07T04:18:32.811609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16075","last_updated":"2024-12-20T17:19:24Z","snapshot_observed_at":"2026-08-11T10:46:49.282021Z","submitted_at":"2024-12-20T17:19:24Z","title":"Formal Mathematical Reasoning: A New Frontier in AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16075","snapshot_observed_at":"2026-08-07T04:18:32.934134Z","title":"Formal mathematical reasoning: A new frontier in ai, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.934134Z"},"links":{"cited_paper":"/paper/2412.16075","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:244592bc02fe6493457288d07d694b81104216d2ab05d144e99d7efe2202b67c","observation_id":"ed735183-5cc2-4980-b111-503812ddb3c8","resolution":{"observed_at":"2026-08-07T04:18:32.934134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:33.046527Z","title":"Logic-LM: Empowering large language models with symbolic solvers for faithful logical reasoning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.046527Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:9707e896d7b7d4888bee6c7281f32065323575efd132ef554252f258f5deab1b","observation_id":"f4062c19-fdea-48f6-8940-82595d81160d","resolution":{"observed_at":"2026-08-07T04:18:33.046527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24264","last_updated":"2025-05-30T06:38:39Z","snapshot_observed_at":"2026-08-14T01:49:25.974127Z","submitted_at":"2025-05-30T06:38:39Z","title":"Faithful and Robust LLM-Driven Theorem Proving for NLI Explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24264","snapshot_observed_at":"2026-08-07T04:18:33.164701Z","title":"Faithful and robust llm-driven theorem proving for nli explanations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.164701Z"},"links":{"cited_paper":"/paper/2505.24264","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:dde1b464d095e5d3bb4c3c331c4ca7df9dac1f6161cece262f0a155cb5ada8dc","observation_id":"18ad6655-73c1-46cd-81ce-1d69c186e9d8","resolution":{"observed_at":"2026-08-07T04:18:33.164701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:49.531262Z","title":"Dennis, and Andre Freitas","venue":null,"work_id":"4a83a2ee-339d-4b53-a2a9-1dcbcceda8c8","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.300555Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:967db3fedfe926c2ca11477b614dbcf2ce0ffdafeab74e80747ea813145fbfab","observation_id":"dc537e8e-e477-42a3-9675-eb46c219e13b","resolution":{"observed_at":"2026-08-07T04:18:49.647213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:49.279590Z","title":"Autoformalization with large language models","venue":null,"work_id":"bbe5fe87-8d05-4809-8674-ec5bd8a78b2b","year":2022},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.622889Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:0c6b41e3b2d48ec3be63949e2dd59fb9129dcf43d3ee069dc0b32d27f05ddbad","observation_id":"102261bd-0257-4fae-a262-88dc703e0259","resolution":{"observed_at":"2026-08-07T04:18:49.409341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:49.047615Z","title":"Consistent autoformalization for constructing mathematical libraries","venue":null,"work_id":"f2df57e7-0542-4973-953e-6f35eefdc6a8","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.790467Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:0c06dc1ccaae4bc6d3d85b0449fde90fca71919ce366a14144103a1c78716355","observation_id":"adf526b7-37f6-45d8-bf35-408ab94636e4","resolution":{"observed_at":"2026-08-07T04:18:49.157181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:48.749875Z","title":"Formalizing complex mathematical statements with llms: A study on mathematical definitions, 2025","venue":null,"work_id":"f71ada76-6eaf-4e83-8ccc-169d90d6617c","year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.924912Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:d866245182d006c15773a4a41cb6d94acb6de75e9eca8ae01c11f23e4340bde6","observation_id":"8e6ae0de-335e-4f1c-819a-132ccf2cc1fb","resolution":{"observed_at":"2026-08-07T04:18:48.907155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:48.508527Z","title":null,"venue":null,"work_id":"507ab936-1268-4d7a-b3a8-65252789e280","year":2000},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:34.098846Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:863aa808a6a14ff2f316129d066d0a5ec1628cfe3dda420144adf95b2bcdfdaa","observation_id":"001367c0-3118-4ae0-b04d-ac25c0afdc2b","resolution":{"observed_at":"2026-08-07T04:18:48.600638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:48.263156Z","title":"The lean theorem prover (system description)","venue":null,"work_id":"105e5d28-e1e6-4713-8b07-4a9ef008c764","year":2015},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:34.249390Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:1ef4b6e2c9105b4d3e2d3db8e95360398e644d34e7a0b957f4827147987ee6f5","observation_id":"63f2c65f-bb2f-4d83-afa7-582da3a4167a","resolution":{"observed_at":"2026-08-07T04:18:48.397535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:48.031508Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":"0628b607-f118-41e0-b5c7-6163c8ed3570","year":2023},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:34.432097Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:c30b0eaaa6c70657999f06236bc84638a81509a6dcce9c7d0467762f37b249e6","observation_id":"1571152a-433d-4204-9f1e-cd191b04572b","resolution":{"observed_at":"2026-08-07T04:18:48.145267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:47.770391Z","title":"minif2f: a cross-system benchmark for formal olympiad-level mathematics","venue":null,"work_id":"2d05e10d-389e-4779-aa6b-556028cd477b","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:34.562778Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:c84c0f63faa0d04e8cfde2db7c1d4e67d4761c20a8fa14e631f183c38239a645","observation_id":"74021821-a3e1-4a4a-bbd9-23a8a17e825f","resolution":{"observed_at":"2026-08-07T04:18:47.862292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:34.919040Z","title":"Ayers, Dragomir Radev, and Jeremy Avigad","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:34.919040Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:e923ac248d8fa80dc5113705a51762bf77865be6e322120674c7c3a0220331e1","observation_id":"47aac0b0-bdfe-42a6-9f1b-9f7864f60632","resolution":{"observed_at":"2026-08-07T04:18:34.919040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:35.048175Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.048175Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:e60b0b322e289e66be7eb31bd095f8720233ba2dfdd5602aed76f23d4026aa78","observation_id":"37032d3a-37ac-4c07-9d44-6cc6ad0ac01f","resolution":{"observed_at":"2026-08-07T04:18:35.048175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:35.147923Z","title":"chrF: character n-gram F-score for automatic MT evaluation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.147923Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:0d3467a3fce086fb60180dbdf65df5352a039ce2a8d565410d34e6655f9467cc","observation_id":"ae2b1546-3a2c-4ffd-9afa-c804c94c7b7d","resolution":{"observed_at":"2026-08-07T04:18:35.147923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:35.273746Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.273746Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:9dc6f235bed804de51b15f9ce072750ff82c277082c417ab4e634c132c1c5f3b","observation_id":"a9f4a789-209f-490d-9a2b-81fab12a788e","resolution":{"observed_at":"2026-08-07T04:18:35.273746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:18:35.413820Z","title":"Gpt-4 technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.413820Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:81b8915f48c8464b9737ca7c5437f4f21337a53b610cd3d1ae2da1c67567dd1f","observation_id":"2dbd116f-a8d9-41e4-aba6-5a76d2fb2468","resolution":{"observed_at":"2026-08-07T04:18:35.413820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:35.595478Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.595478Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:30297a20ccdccb8ef032b3545f670b09670e36fd17f9d0b6626d38b89142cc43","observation_id":"b52d544c-1183-4060-9c2d-f7634d36decd","resolution":{"observed_at":"2026-08-07T04:18:35.595478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T04:18:35.713877Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.713877Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:038ea3207df054597a09510533c73b663b7faaa566fc3282f03adb1262bfb858","observation_id":"3bea1d13-df8c-486c-bdb5-ece8dbb8bfed","resolution":{"observed_at":"2026-08-07T04:18:35.713877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T04:18:35.867509Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.867509Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:311ca7eab1f1faa34e5aff488f97c62f2378057d16136e6f7d54fd6d2e9797ba","observation_id":"333f42d6-2093-4662-8ca7-c489eabde370","resolution":{"observed_at":"2026-08-07T04:18:35.867509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:47.280000Z","title":"Enhancing ethical explanations of large language models through iterative symbolic refinement","venue":null,"work_id":"b80e890f-3655-484e-ac6a-3f53ab1e23e8","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.004769Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:41090ae2de65caefa3e13bb40bd0e0885607e88e5fd61b4db4ea99925903984e","observation_id":"e0644526-4e3a-4db7-b468-0c8f226d2275","resolution":{"observed_at":"2026-08-07T04:18:47.378180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:46.730897Z","title":"Jiang, Daniel Raggi, Wenda Li, and Mateja Jamnik","venue":null,"work_id":"0383820a-0be0-4599-8514-e0d3f133540a","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.305644Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:e7eb0a479b500369e7ccd221a5ec29f03afcb57375c1953ecfbf8e086e8a7ea9","observation_id":"ea25568f-b3a0-4d18-b498-36ba5a2aeae9","resolution":{"observed_at":"2026-08-07T04:18:46.811020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:36.491908Z","title":"Towards autoformalization of mathe- matics and code correctness: Experiments with elementary proofs","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.491908Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:356153dac8f44c4c870a45ad8edce3661bf78e57900b7787ed91fbeaa07b407e","observation_id":"21afc887-d59f-442c-82a1-ae126ab38535","resolution":{"observed_at":"2026-08-07T04:18:36.491908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:46.959315Z","title":"URL https://aclanthology.org/2024","venue":null,"work_id":"94cb2b17-c5ce-4a4b-ad80-a97b9f3dc807","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.188422Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:98d151ef4a57e27f7af42a5c4e7b7f36c867d56a3080beeee5cbdefed73ab21b","observation_id":"beb74f61-cf34-4f7f-b3da-6085559f02c7","resolution":{"observed_at":"2026-08-07T04:18:47.098812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:46.495646Z","title":"Rethinking and improving autoformalization: towards a faithful metric and a dependency retrieval-based approach","venue":null,"work_id":"e784137f-8838-40f0-9ae0-5a8a68d57ce4","year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.813396Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:25fc2033d206c7eefe0411a04abc08f8de4f8ed615e9e64191eebb69c0a1ebc8","observation_id":"cd3f2379-5699-4520-b467-8e93aef866b3","resolution":{"observed_at":"2026-08-07T04:18:46.618070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:46.271319Z","title":"Process-driven autoformalization in lean 4, 2024","venue":null,"work_id":"a04bb0fa-8cfc-45a6-804a-ac77697e40be","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.948080Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:e526d4ddc4289bd67333092adfc122e81e910b3bd73f93bc6d5317b187aa5af7","observation_id":"c3cdeb5b-e500-453a-b856-ef46c5be2a5b","resolution":{"observed_at":"2026-08-07T04:18:46.352503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15626","last_updated":"2023-10-27T16:00:20Z","snapshot_observed_at":"2026-08-13T11:08:13.494680Z","submitted_at":"2023-06-27T17:05:32Z","title":"LeanDojo: Theorem Proving with Retrieval-Augmented Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15626","snapshot_observed_at":"2026-08-07T04:18:36.682669Z","title":"Swope, Alex Gu, Rahul Chalamala, Peiyang Song, Shixing Yu, Saad Godil, Ryan Prenger, and Anima Anandkumar","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.682669Z"},"links":{"cited_paper":"/paper/2306.15626","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:c01216f5c1c62074eb49b63c6d84f2a7586e1d473d356165300b6cc85968d134","observation_id":"1d0d0b32-4316-4192-aeff-b148aa2ea300","resolution":{"observed_at":"2026-08-07T04:18:36.682669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:46.039749Z","title":"Jiang, Wenda Li, and Mateja Jamnik","venue":null,"work_id":"fad8e67a-4174-4871-9fbb-102f098988d9","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.243294Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:2091746ded19b1ec83480f0e1ec9dcfc94542a2fdcc40ee70051729b33ee4bf6","observation_id":"6ff906c5-70ef-4cef-bbb5-3508baaec954","resolution":{"observed_at":"2026-08-07T04:18:46.159363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:45.820788Z","title":"Atlas: Autoformalizing theorems through lifting, augmentation, and synthesis of data,","venue":null,"work_id":"a63428bb-52e2-42c5-b548-2b64fd3f8ca4","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.400350Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:8609a81459f4a28d1186076081c6240da4df0b1d33a968999c79f22f6f2ab333","observation_id":"4d3ae176-89da-43b3-b7e4-412ae99385df","resolution":{"observed_at":"2026-08-07T04:18:45.933592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:37.081378Z","title":"Autoformalize mathematical statements by symbolic equivalence and semantic consistency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.081378Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:43bc94c5563f472f0426694161161ba4e89dd61327ab791abf9d169ef9165424","observation_id":"0c7db4fb-86ba-4368-8d0f-462518c4710f","resolution":{"observed_at":"2026-08-07T04:18:37.081378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10135","last_updated":"2024-10-14T03:58:35Z","snapshot_observed_at":"2026-08-12T22:24:07.669100Z","submitted_at":"2024-10-14T03:58:35Z","title":"FormalAlign: Automated Alignment Evaluation for Autoformalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10135","snapshot_observed_at":"2026-08-07T04:18:37.768435Z","title":"Formalalign: Automated alignment evaluation for autoformalization, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.768435Z"},"links":{"cited_paper":"/paper/2410.10135","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:d7bac0a1c6951a49d82096509d6eab9583f93caa2e79b15601e6db9775a602c0","observation_id":"1eaac6e5-82b5-4339-91d3-8e3d656f47f4","resolution":{"observed_at":"2026-08-07T04:18:37.768435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:37.937243Z","title":"Branch-solve-merge improves large language model evaluation and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.937243Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:dde6c830e147ff7887278696b60f119e1e25ac7ab43579780c68590ff305a0fd","observation_id":"6ad1e9c1-7d6d-4634-a860-c8a043088537","resolution":{"observed_at":"2026-08-07T04:18:37.937243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-12T23:08:15.634578Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-07T04:18:38.084976Z","title":"Self-taught evaluators, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.084976Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:122bab17d3addf6066b7beb1691362fba4bb1bfe56efa2150e071bcf72bac84b","observation_id":"f6fc7ac3-3d55-4304-b3b2-e556f1ec9ee3","resolution":{"observed_at":"2026-08-07T04:18:38.084976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:37.664687Z","title":"Improving autoformaliza- tion using type checking, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.664687Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:32b40fcca63ac7f0783fb0e3879e642c0b9b92dce49013f9c009dffdc45def8f","observation_id":"60ff8893-e2a2-41f5-ae70-28be40973b6a","resolution":{"observed_at":"2026-08-07T04:18:37.664687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:38.375950Z","title":"J1: Incentivizing thinking in llm-as-a-judge via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.375950Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:610a4407d586c77ae0603ecd70332de4ecc9b229be028a2d7c3f49203938a912","observation_id":"1d1f828f-2576-4cfa-bf83-6ca7805c7c51","resolution":{"observed_at":"2026-08-07T04:18:38.375950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18403","last_updated":"2025-06-02T11:31:19Z","snapshot_observed_at":"2026-08-12T23:34:25.129632Z","submitted_at":"2024-06-26T14:56:13Z","title":"LLMs instead of Human Judges? A Large Scale Empirical Study across 20 NLP Evaluation Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18403","snapshot_observed_at":"2026-08-07T04:18:38.572175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.572175Z"},"links":{"cited_paper":"/paper/2406.18403","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:58314a0b73ae8dca30339d57b0a79ee2cb937482054769379d5833933da9f681","observation_id":"15a2d426-3228-482a-9c22-0ce3cae0da50","resolution":{"observed_at":"2026-08-07T04:18:38.572175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-13T06:43:22.011336Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T04:18:38.698535Z","title":"A survey on llm-as-a-judge, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.698535Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:222d978f3abe8012470402c6b0ed1c87ff847cf4e3d851da20302afc230c8cd4","observation_id":"dd5a74ee-294e-4314-a397-44d9d4c9fc11","resolution":{"observed_at":"2026-08-07T04:18:38.698535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12501","last_updated":"2025-04-07T05:22:27Z","snapshot_observed_at":"2026-08-07T18:10:20.154725Z","submitted_at":"2025-02-18T03:31:06Z","title":"Crowd Comparative Reasoning: Unlocking Comprehensive Evaluations for LLM-as-a-Judge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12501","snapshot_observed_at":"2026-08-07T04:18:38.239873Z","title":"Crowd comparative reasoning: Unlocking comprehensive evaluations for llm-as-a-judge, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.239873Z"},"links":{"cited_paper":"/paper/2502.12501","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:069b418672ac71c0bb6d5a922c3963e7d998dc30b07322f27a0c93ebe2ff0de0","observation_id":"24134fc3-59a4-4513-8ce4-0d407d1b94e2","resolution":{"observed_at":"2026-08-07T04:18:38.239873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23754","last_updated":"2025-06-03T11:23:21Z","snapshot_observed_at":"2026-08-13T23:14:07.424756Z","submitted_at":"2025-05-29T17:59:39Z","title":"DeepTheorem: Advancing LLM Reasoning for Theorem Proving Through Natural Language and Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23754","snapshot_observed_at":"2026-08-07T04:18:39.132366Z","title":"Deeptheorem: Advancing llm reasoning for theorem proving through natural language and reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.132366Z"},"links":{"cited_paper":"/paper/2505.23754","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:84f4f3390d13036680da07df51b04f66dcc3853f5f73053373bfcc9d9fbd8db6","observation_id":"433988b7-2bc8-4b3d-8835-dbc4e74d7e36","resolution":{"observed_at":"2026-08-07T04:18:39.132366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:45.565762Z","title":"Assessing judging bias in large reasoning models: An empirical study,","venue":null,"work_id":"11622d72-8ade-40a9-8ffd-1ff73d42cb84","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.874413Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:5f6874914e26c2ad91347d57244b176732755737913f8ff207f1b0968eab82e0","observation_id":"e654143c-fe28-4cd0-84c9-265a5007d2e5","resolution":{"observed_at":"2026-08-07T04:18:45.671838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-08-07T04:18:39.012600Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.012600Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:0fa7f569ae585d5f7adfa1f7f75c60f1a29c0791b57bfc8d7cbd754d422e0ea1","observation_id":"9c5711f3-5794-460f-a6df-54f652c3d180","resolution":{"observed_at":"2026-08-07T04:18:39.012600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:45.292944Z","title":null,"venue":null,"work_id":"402cefa5-d70a-4815-a7fd-5bcde770fcd9","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.261252Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:d58bf5ed980c4faf401d60370673c16b5537dafef3276269714ea8a110c9a3c6","observation_id":"4c1bd57e-0c22-4e90-a74f-5c29b3d838a0","resolution":{"observed_at":"2026-08-07T04:18:45.443347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:44.967555Z","title":null,"venue":null,"work_id":"f1d587dc-338a-4112-90e1-8f592a798e65","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.461393Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:84f08f155f2fdc2e22d208282dbe264b8c9b4a65f43e90685eeb453dea6894e0","observation_id":"9a85e2f3-ae8e-401a-ba33-8a3d30b96e77","resolution":{"observed_at":"2026-08-07T04:18:45.103398Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:44.785563Z","title":null,"venue":null,"work_id":"19fda17b-8ae6-4d44-b58e-76da8743747c","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.614636Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:9154419742e400800d7997d487851980c92b13283c4b57b405dfccc556beba9f","observation_id":"b7e0f182-6e81-4afe-bbf3-58e4cf7353f8","resolution":{"observed_at":"2026-08-07T04:18:44.912106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:44.557739Z","title":null,"venue":null,"work_id":"0745f265-a947-4321-b416-94287c57c16a","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.767627Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:39a7e1fa4cc0e986898deda6973611fe194f7ab265b36ba0408246de37005ae4","observation_id":"781f4874-c6f8-4d24-9488-e7af0ab01019","resolution":{"observed_at":"2026-08-07T04:18:44.668304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:44.273045Z","title":null,"venue":null,"work_id":"e52d96a9-5baa-4c0a-9cf0-ed53a2eec893","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.871380Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:3cf14824f69958384a7aff42696b5e4d25dea96ae354990f3d41c3c0df7acd42","observation_id":"107593b5-e04c-4598-a95c-eeff9355911f","resolution":{"observed_at":"2026-08-07T04:18:44.419887Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:44.058644Z","title":null,"venue":null,"work_id":"383e4350-84c5-41b2-a608-c84920345da8","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.985638Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:d5f9b6f4f198bd6668c029da1d8a11566fcc38d8b722784ee9a3d8f21b2d29d2","observation_id":"17c5e063-8659-4a54-88b3-01b9a2313b6c","resolution":{"observed_at":"2026-08-07T04:18:44.160267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:43.831904Z","title":null,"venue":null,"work_id":"5a9659c4-db37-4b8d-a68e-cee4ca4a5f0b","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.098574Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:e83c5fea79ea9613270fdbceb7d83ed6b07cf9bc983b6a0341073277726d0f81","observation_id":"02ace0ff-3be6-4064-90f0-162cfda66110","resolution":{"observed_at":"2026-08-07T04:18:43.942277Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:43.525576Z","title":null,"venue":null,"work_id":"aea423f8-e06a-4527-a738-7530a719329a","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.263334Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:68007131eb9827271006d22f38a33c28fa386792443c7af8694a6ede62cea936","observation_id":"6d05781f-064a-4e99-a2e0-8036bf1498e3","resolution":{"observed_at":"2026-08-07T04:18:43.688713Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:43.267630Z","title":null,"venue":null,"work_id":"bb888837-1e27-4258-b0e9-2098a19552bc","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.380673Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:66350715809192707bb6ea50c3cfb59376ad926d2cff9725e4aea3281df0ae48","observation_id":"261fb21b-acc0-4aff-a9c7-ddeb5b01092c","resolution":{"observed_at":"2026-08-07T04:18:43.407700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:43.008415Z","title":null,"venue":null,"work_id":"8eaffedc-a659-47da-896c-737c5e2d100a","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.502132Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:3f89af30747837f070f1220958d3bbe2a2ec3d38d7d7b800c45d405e1af2fc14","observation_id":"8118648f-d720-48bd-80e6-5e44868d4b3e","resolution":{"observed_at":"2026-08-07T04:18:43.093832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:42.703772Z","title":null,"venue":null,"work_id":"b6ae9eb7-21f6-4315-8ee4-ca8c0cf86860","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.606262Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:3cc938a0d8c2ec382a6d29efc90d89dae058eedd2b1b49a60d801d08ae56a2db","observation_id":"f8b51ee0-2a3b-467c-b8e0-6b74b0b14180","resolution":{"observed_at":"2026-08-07T04:18:42.853290Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:42.414231Z","title":"15 Purpose Content Basic You are an expert in formal language {formal_language}","venue":null,"work_id":"14211ce0-79e6-4356-994e-b62ff735424c","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.724866Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:2ae705b0ec9ad0645687ff98bead57c13a1ed9e92a45b47d06a524b993600fb8","observation_id":"e6df49b0-4b5a-4383-b759-d4e3c3a6c432","resolution":{"observed_at":"2026-08-07T04:18:42.549214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:42.123115Z","title":"True\" or","venue":null,"work_id":"f89978ad-7aa9-490c-b617-fac4f965a2ce","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.886817Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:3704330da4cd32fa2fc17754c8ad9305d0886a9728dc3e6d3cda61d189ba2798","observation_id":"79f0eca7-498c-42f9-a217-827f750abd28","resolution":{"observed_at":"2026-08-07T04:18:42.266962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:41.885083Z","title":"real ⇒ real","venue":null,"work_id":"ccbe4b32-2f44-4900-a699-f47cafed3738","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:41.054671Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:6802866285ebfaf7341c75749c5fa11f598811da59677f029a28e7a3b959fc09","observation_id":"5f14c5e3-8597-4858-8fe3-ed2c9e6a390f","resolution":{"observed_at":"2026-08-07T04:18:41.953448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:47.548105Z","title":null,"venue":null,"work_id":"79ad63ef-90fa-4bfe-a382-0e2b7ba46edd","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:34.757295Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:e19514d30b56b083a533376f9235ea9d076e6e31c997511ee5860840aa035c59","observation_id":"49864cd8-4a36-4a36-a88a-5d12268d63a7","resolution":{"observed_at":"2026-08-07T04:18:47.645468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:33.473040Z","title":"doi: 10.18653/v1/2024.emnlp-main.172","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.473040Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:583e892bb091a0d837919cf174f08451f19f4dbc1be1634dff0cd9bda20cc42f","observation_id":"315b83f6-3c65-4b4b-84f5-c33ba707b30e","resolution":{"observed_at":"2026-08-07T04:18:33.473040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:37.536531Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.536531Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:7f3ac52cfd3367a7a36fd785ee50323c21bc04d45e3deee40d1cc53892f40e66","observation_id":"d0d82ccf-bfb5-44be-bf8e-eb045006c155","resolution":{"observed_at":"2026-08-07T04:18:37.536531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T09:15:13.640616Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 1 inbound Pith citation observation for arXiv:2506.10903."}