{"as_of":"2026-08-10T06:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b3c88258176ba06092a9f3608b906164a75b11dd302bf8686aff33c83a0a623c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T17:36:09.593630Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-24T01:18:42.212282Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.05692","last_updated":"2025-01-14T05:39:40Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:18:04Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy","version":2},"cited_work":{"arxiv_id":"2404.05692","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05692","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating mathematical reasoning beyond accuracy","venue":null,"work_id":"b2ea2f90-9303-45bd-b0f3-f69dd12ff165","year":2024},"citing_paper":{"arxiv_id":"2405.02079","last_updated":"2025-04-18T11:20:24Z","snapshot_observed_at":"2026-08-03T06:11:43.529044Z","submitted_at":"2024-05-03T13:12:28Z","title":"Argumentative Large Language Models for Explainable and Contestable Claim Verification","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-24T01:17:26.111194Z"},"links":{"cited_paper":"/paper/2404.05692","citing_paper":"/paper/2405.02079"},"observation_digest":"sha256:db92f138627f2b2e049b1ce9781994ce556549eb14b70be7e38825efb5c40fcc","observation_id":"f178788d-e957-46c9-aa93-bdc4602c3dc7","resolution":{"observed_at":"2026-05-24T01:18:42.215283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05692","last_updated":"2025-01-14T05:39:40Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:18:04Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy","version":2},"cited_work":{"arxiv_id":"2404.05692","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05692","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating mathematical reasoning beyond accuracy","venue":null,"work_id":"b2ea2f90-9303-45bd-b0f3-f69dd12ff165","year":2024},"citing_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-07-31T01:42:39.468673Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"reference_index":255,"source":"pdf_text","source_observed_at":"2026-05-11T23:08:34.312466Z"},"links":{"cited_paper":"/paper/2404.05692","citing_paper":"/paper/2412.05579"},"observation_digest":"sha256:d223d1da11b99272faa920e83a595c0b8e83b960582f425a4da0ba998eae75a7","observation_id":"15f17f9f-1ffd-4a8c-a75e-a1efc487a441","resolution":{"observed_at":"2026-05-11T23:08:35.714529Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05692","last_updated":"2025-01-14T05:39:40Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:18:04Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy","version":2},"cited_work":{"arxiv_id":"2404.05692","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05692","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating mathematical reasoning beyond accuracy","venue":null,"work_id":"b2ea2f90-9303-45bd-b0f3-f69dd12ff165","year":2024},"citing_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-13T17:36:27.515468Z"},"links":{"cited_paper":"/paper/2404.05692","citing_paper":"/paper/2501.05366"},"observation_digest":"sha256:90bc6b7de8b123b9381abcd8bfd2a2d051008262b3eb83bb8338d16024632286","observation_id":"b4036418-9035-4e62-8eee-eea1dd8b4745","resolution":{"observed_at":"2026-05-13T17:36:27.607831Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05692","last_updated":"2025-01-14T05:39:40Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:18:04Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy","version":2},"cited_work":{"arxiv_id":"2404.05692","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05692","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating mathematical reasoning beyond accuracy","venue":null,"work_id":"b2ea2f90-9303-45bd-b0f3-f69dd12ff165","year":2024},"citing_paper":{"arxiv_id":"2501.07301","last_updated":"2025-06-05T16:34:24Z","snapshot_observed_at":"2026-08-03T11:11:25.359494Z","submitted_at":"2025-01-13T13:10:16Z","title":"The Lessons of Developing Process Reward Models in Mathematical Reasoning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T13:43:43.223872Z"},"links":{"cited_paper":"/paper/2404.05692","citing_paper":"/paper/2501.07301"},"observation_digest":"sha256:42b0a5e60a9e042deb6eeabfe574eb016d00a755f3b089e4e2d2d9abb7428988","observation_id":"977327ef-1778-476a-927d-6e99c908dbfb","resolution":{"observed_at":"2026-05-16T13:43:43.280619Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05692","last_updated":"2025-01-14T05:39:40Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:18:04Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05692","snapshot_observed_at":"2026-08-09T17:36:09.593630Z","title":"Evaluating mathematical reasoning beyond accuracy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00855","last_updated":"2025-02-02T17:00:22Z","snapshot_observed_at":"2026-08-09T21:06:33.541090Z","submitted_at":"2025-02-02T17:00:22Z","title":"Psychometric-Based Evaluation for Theorem Proving with Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T17:36:09.593630Z"},"links":{"cited_paper":"/paper/2404.05692","citing_paper":"/paper/2502.00855"},"observation_digest":"sha256:9ebe1cca3fc57fab92616b8296ae7a14d4f9e24b83b5c6b928aff9cdc17f49db","observation_id":"aa175261-3913-4a31-b455-920faa242b10","resolution":{"observed_at":"2026-08-09T17:36:09.593630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05692","last_updated":"2025-01-14T05:39:40Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:18:04Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy","version":2},"cited_work":{"arxiv_id":"2404.05692","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05692","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating mathematical reasoning beyond accuracy","venue":null,"work_id":"b2ea2f90-9303-45bd-b0f3-f69dd12ff165","year":2024},"citing_paper":{"arxiv_id":"2505.04588","last_updated":"2026-05-19T11:51:42Z","snapshot_observed_at":"2026-08-04T18:36:41.979541Z","submitted_at":"2025-05-07T17:30:22Z","title":"ZeroSearch: Incentivize the Search Capability of LLMs without Searching","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-17T17:44:13.310155Z"},"links":{"cited_paper":"/paper/2404.05692","citing_paper":"/paper/2505.04588"},"observation_digest":"sha256:80a13e4c2bd8a7e26221ac8f97327e5d646bc0f850c6b8fdbc8468d2008a7a79","observation_id":"1a10fcd9-a429-4fee-9e60-96538d4d4078","resolution":{"observed_at":"2026-05-17T17:44:13.407243Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05692","last_updated":"2025-01-14T05:39:40Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:18:04Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy","version":2},"cited_work":{"arxiv_id":"2404.05692","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05692","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating mathematical reasoning beyond accuracy","venue":null,"work_id":"b2ea2f90-9303-45bd-b0f3-f69dd12ff165","year":2024},"citing_paper":{"arxiv_id":"2505.04588","last_updated":"2026-05-19T11:51:42Z","snapshot_observed_at":"2026-08-04T18:36:41.979541Z","submitted_at":"2025-05-07T17:30:22Z","title":"ZeroSearch: Incentivize the Search Capability of LLMs without Searching","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T16:05:04.715678Z"},"links":{"cited_paper":"/paper/2404.05692","citing_paper":"/paper/2505.04588"},"observation_digest":"sha256:7b7d6ad7796ae3f5925138cc75cfa9dd05b354d03cb5dbf47e117a8156e478ff","observation_id":"f9335210-c8ab-4c38-b471-6f8617752a2e","resolution":{"observed_at":"2026-05-22T16:06:46.064052Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05692","last_updated":"2025-01-14T05:39:40Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:18:04Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05692","snapshot_observed_at":"2026-08-07T15:16:03.607802Z","title":"Evaluating mathematical reasoning beyond accuracy.arXiv preprint arXiv:2404.05692, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15623","last_updated":"2025-05-21T15:12:20Z","snapshot_observed_at":"2026-08-09T11:08:02.452021Z","submitted_at":"2025-05-21T15:12:20Z","title":"Can LLMs $\\textit{understand}$ Math? -- Exploring the Pitfalls in Mathematical Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:16:03.607802Z"},"links":{"cited_paper":"/paper/2404.05692","citing_paper":"/paper/2505.15623"},"observation_digest":"sha256:defa1d2882411b137a274aaca915c9ddabbfd216d6ac68422bf410d4491d0cd0","observation_id":"f5850eb5-d7ce-4d39-b47d-2682eaf22035","resolution":{"observed_at":"2026-08-07T15:16:03.607802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05692","last_updated":"2025-01-14T05:39:40Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:18:04Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05692","snapshot_observed_at":"2026-08-07T11:26:06.792641Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02592","last_updated":"2025-06-03T08:12:47Z","snapshot_observed_at":"2026-08-07T15:19:01.070855Z","submitted_at":"2025-06-03T08:12:47Z","title":"Beyond the Surface: Measuring Self-Preference in LLM Judgments","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T11:26:06.792641Z"},"links":{"cited_paper":"/paper/2404.05692","citing_paper":"/paper/2506.02592"},"observation_digest":"sha256:910c025b08e585c9617ad8fedef2f4cfb3912e4383e506afe54682769205b3f1","observation_id":"ac304e2e-cc51-4890-80b2-814a8191dc1f","resolution":{"observed_at":"2026-08-07T11:26:06.792641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05692","last_updated":"2025-01-14T05:39:40Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:18:04Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy","version":2},"cited_work":{"arxiv_id":"2404.05692","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05692","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating mathematical reasoning beyond accuracy","venue":null,"work_id":"b2ea2f90-9303-45bd-b0f3-f69dd12ff165","year":2024},"citing_paper":{"arxiv_id":"2507.15698","last_updated":"2026-05-19T07:11:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-21T15:07:59Z","title":"CoLD: Counterfactually-Guided Length Debiasing for Process Reward Models in Mathematical Reasoning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T23:24:43.556606Z"},"links":{"cited_paper":"/paper/2404.05692","citing_paper":"/paper/2507.15698"},"observation_digest":"sha256:d3109d8e3a5bcdbdd56a2b81e84b79b52a970d86ae139f3ec87412736a3c9aae","observation_id":"099e8384-6906-4034-833d-cc9237fa9108","resolution":{"observed_at":"2026-05-21T23:25:45.320305Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05692","last_updated":"2025-01-14T05:39:40Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:18:04Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy","version":2},"cited_work":{"arxiv_id":"2404.05692","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05692","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating mathematical reasoning beyond accuracy","venue":null,"work_id":"b2ea2f90-9303-45bd-b0f3-f69dd12ff165","year":2024},"citing_paper":{"arxiv_id":"2604.17282","last_updated":"2026-04-19T06:44:07Z","snapshot_observed_at":"2026-08-07T16:01:14.024764Z","submitted_at":"2026-04-19T06:44:07Z","title":"MedPRMBench: A Fine-grained Benchmark for Process Reward Models in Medical Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T05:58:03.842336Z"},"links":{"cited_paper":"/paper/2404.05692","citing_paper":"/paper/2604.17282"},"observation_digest":"sha256:ba8125c479b528fbd366cdecb8cd7b9555930d0f6c6afc5fe2ab3810b77b542e","observation_id":"e0c99724-da9c-43e0-86ec-f3d9352560a3","resolution":{"observed_at":"2026-05-10T06:01:13.445322Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2404.05692/citation-record","integrity":"/paper/2404.05692/integrity","json":"/paper/2404.05692/citation-record.json","paper":"/paper/2404.05692"},"outbound":[],"paper":{"arxiv_id":"2404.05692","last_updated":"2025-01-14T05:39:40Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:18:04Z","title":"Evaluating Mathematical Reasoning Beyond Accuracy"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2404.05692."}