{"as_of":"2026-08-06T13:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:262b2751141ed1a6c9fde8623cfbfc0e5e4b6f06e0c5777ef9bce9c0f81c45c7","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T22:24:04.625823Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T07:51:11.899943Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T05:47:40.989192Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"cited_work":{"arxiv_id":"2605.09063","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.09063","snapshot_observed_at":"2026-07-03T05:47:40.989192Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","venue":"cs.CL","work_id":"d05247e7-0c08-4462-84aa-32f39bb50ef0","year":2026},"citing_paper":{"arxiv_id":"2606.03991","last_updated":"2026-06-06T17:34:11Z","snapshot_observed_at":"2026-07-06T23:44:09.692359Z","submitted_at":"2026-06-02T17:59:53Z","title":"The Grothendieck Constant is Less Than $\\frac{\\pi}{2 \\log (1+ \\sqrt{2})} - 10^{-5}$","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T07:51:11.899943Z"},"links":{"cited_paper":"/paper/2605.09063","citing_paper":"/paper/2606.03991"},"observation_digest":"sha256:e25648373248c4ab7b32171b834b445568d22bbc23ad13ee85b4cbc2f466240a","observation_id":"0bf0fcdc-f168-49ac-92a1-d9fc0155ca72","resolution":{"observed_at":"2026-07-02T05:56:40.849823Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"cited_work":{"arxiv_id":"2605.09063","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.09063","snapshot_observed_at":"2026-07-03T05:47:40.989192Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","venue":"cs.CL","work_id":"d05247e7-0c08-4462-84aa-32f39bb50ef0","year":2026},"citing_paper":{"arxiv_id":"2606.10403","last_updated":"2026-06-11T09:33:19Z","snapshot_observed_at":"2026-07-31T16:50:09.777225Z","submitted_at":"2026-06-09T04:25:44Z","title":"KCSAT-ML: Probing Reasoning Models with Nationwide-Cohort Human Difficulty","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T13:07:59.509660Z"},"links":{"cited_paper":"/paper/2605.09063","citing_paper":"/paper/2606.10403"},"observation_digest":"sha256:6bbe29557ad4ed81dc64359f40eae530ea86dd2e7f81e782819a7ed3065e615e","observation_id":"45112da2-8c11-43a0-94e7-905139f528e5","resolution":{"observed_at":"2026-07-03T05:47:40.990435Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.09063/citation-record","integrity":"/paper/2605.09063/integrity","json":"/paper/2605.09063/citation-record.json","paper":"/paper/2605.09063"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.05192","doi":"10.48550/arxiv.2602.05192","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"First proof","venue":"arXiv (Cornell University)","work_id":"0df5eef4-9d07-4838-bd4c-1772ece29fb8","year":2026},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:dfceb026d571773422aeac4150c55d3400d5a1d4a4e7e37bb8668c544791b3ab","observation_id":"38c89c7f-3209-4905-8b46-a641290d7539","resolution":{"observed_at":"2026-05-20T22:24:07.808603Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":"2508.10925","doi":"10.3115/1073083.1073135","metadata_source":"pith","pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","venue":"cs.CL","work_id":"178c1f7e-4f19-4392-a45d-45a6dfa88ead","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:5fb5ae1950301ffcee2f82c9a2b371c0a77a5d19ac07178edec7bb193bfc9684","observation_id":"cdae6753-e705-4059-8556-940d462018bc","resolution":{"observed_at":"2026-05-20T22:24:07.725125Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.29961","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T22:07:26.017910Z","title":"Short proofs in combinatorics and number theory","venue":null,"work_id":"2d8ee5e9-938d-4e35-bbd4-75e272ff99dd","year":2026},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:efba83f690671c1947b9d725c94d227e73b55a99f1a4b01429ffc23eadb5a61b","observation_id":"85c8bf02-d036-431b-ade6-140fe17ab51b","resolution":{"observed_at":"2026-05-20T22:24:07.813826Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06609","last_updated":"2026-04-08T02:42:30Z","snapshot_observed_at":"2026-07-06T22:55:01.863342Z","submitted_at":"2026-04-08T02:42:30Z","title":"Short proofs in combinatorics, probability and number theory II","version":1},"cited_work":{"arxiv_id":"2604.06609","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.06609","snapshot_observed_at":"2026-06-30T18:14:59.763136Z","title":"Short proofs in combinatorics, probability and number theory II","venue":"math.CO","work_id":"b83f5cde-eac2-43c2-bee6-2ef2c86009db","year":2026},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2604.06609","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:f4e800ef8ec2904a025dcf06ed3d4fd63282d3decb2b14792a9988287a903c29","observation_id":"f89f8194-a745-4f4d-8f3f-04bf5530b99d","resolution":{"observed_at":"2026-05-20T22:24:07.738214Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.26768","doi":"10.48550/arxiv.2510.26768","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2510.26768 , year=","venue":"arXiv (Cornell University)","work_id":"c293420a-3806-46e9-98bc-1d7f3259b246","year":2026},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:8b63c7ff0840db4e8c38dc5d513571adc240f65c3259791f62412e5b04b911df","observation_id":"c864122a-58ab-4fb5-a663-b762f98c04a2","resolution":{"observed_at":"2026-05-20T22:24:07.763874Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing Claude Opus 4.5","venue":null,"work_id":"69bad2c7-7005-4ce5-82e1-63165b973400","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:a9c64760b3f1923a0253f946145efc73a9a758026b919941c612583dee30cc58","observation_id":"2aad720e-23ce-408a-a2fb-784ad312714c","resolution":{"observed_at":"2026-05-20T22:24:07.870333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"American invitational mathematics examination (aime)","venue":null,"work_id":"c006bcb5-a8d2-4373-b441-7e6cc101d73b","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:5e05b4a6711ef03b636fd87d1270ce5eeb8b0293a2fc1d1fa7144a0f23617f5e","observation_id":"6012d70c-aa78-43a1-beb8-7e0b003f744f","resolution":{"observed_at":"2026-05-20T22:24:07.854933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"63d6fda4-7c28-4cf0-b14a-65b404d521e4","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:578672e3f85940e96a637a73999dc2405cfc200c6793f3349d32f3aeff610e94","observation_id":"f1b1ae87-2f79-4e0a-9a1e-d8c4e2ad425a","resolution":{"observed_at":"2026-05-20T22:24:07.842239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"28adb64a-6b67-4103-8403-86a85828dc4d","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:6b98ff71aaa81f928e2ffa00b19f4a4abee6fe602dc836db872112a012c1aae1","observation_id":"1e19bb32-85f4-4727-8f1f-879be06ab68c","resolution":{"observed_at":"2026-05-20T22:24:07.863939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BeyondAIME: Advancing Math Reasoning Evaluation Beyond High School Olympiads.https://huggingface.co/datasets/ByteDance-Seed/BeyondAIME","venue":null,"work_id":"06f47284-81b2-4a41-af83-16d2deee383f","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:3ddf909a94543ea488026fd61f9b97b1733ad8190410e7b9d44e8a06989b587e","observation_id":"0d4cbd5c-3505-42aa-b55a-ddb77199a841","resolution":{"observed_at":"2026-05-20T22:24:07.846216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-04T15:46:25.710484Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:ce8d562c394bb36de072f3c8804e25baf4d003a3143a49f8c0d7727f4951f003","observation_id":"9a03e198-29f0-4da6-9689-5c790437e349","resolution":{"observed_at":"2026-05-20T22:24:07.758847Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.22401","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T18:17:33.715410Z","title":"Semi-autonomous mathematics discovery with gemini: A case study on the erd\\h{o}s problems","venue":null,"work_id":"95c9045d-95fe-42f1-a7bb-f3bd80e16dee","year":2026},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:d554e85f9c404ca9d00cecf1175b465f22384ca3c82b491f34f66fed9e8ac225","observation_id":"2c511fb0-790b-4135-b25e-d015c5fd964f","resolution":{"observed_at":"2026-05-20T22:24:07.791742Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a3a127ef-cbc0-4292-9869-8724e00a16ab","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:6331dd0a5b27f4272b5c251f71c599546cd0b5bf620a1e2abf4ea8067449e949","observation_id":"0432c9a3-ce2d-4d1b-bd25-f8a8e39e01c2","resolution":{"observed_at":"2026-05-20T22:24:07.849288Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06802","last_updated":"2026-06-23T06:45:36Z","snapshot_observed_at":"2026-07-13T08:50:52.244397Z","submitted_at":"2026-04-08T08:16:37Z","title":"Riemann-Bench: A Benchmark for Moonshot Mathematics","version":3},"cited_work":{"arxiv_id":"2604.06802","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.06802","snapshot_observed_at":"2026-06-29T13:23:27.854259Z","title":"Riemann-Bench: A Benchmark for Moonshot Mathematics","venue":"cs.AI","work_id":"f8e45bf8-38f2-45f8-9c24-c9aa7da57caf","year":2026},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2604.06802","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:17ff47fc13fc70980e2e6a7d4c3e51e5550dc04b9d182e2aea1d650d38c11ef9","observation_id":"ec04da43-7cfd-4db6-aef1-7502e4f8a40e","resolution":{"observed_at":"2026-05-20T22:24:07.752946Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04872","last_updated":"2025-12-23T02:23:47Z","snapshot_observed_at":"2026-08-04T15:54:46.196160Z","submitted_at":"2024-11-07T17:07:35Z","title":"FrontierMath: A Benchmark for Evaluating Advanced Mathematical Reasoning in AI","version":7},"cited_work":{"arxiv_id":"2411.04872","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.04872","snapshot_observed_at":"2026-07-10T20:47:34.579097Z","title":"FrontierMath: A Benchmark for Evaluating Advanced Mathematical Reasoning in AI","venue":"cs.AI","work_id":"ad91b1d8-7c7c-4daf-8c63-8f81bb5a810a","year":2024},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2411.04872","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:a2472e6fd2be2031624ef6a2fa6fe7595a3ced1e62723f6c34465c5d88a3b1ec","observation_id":"5d266f89-6a95-46b4-a4c1-16f6e7516e9e","resolution":{"observed_at":"2026-05-20T22:24:07.822738Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemini 3.1 Pro.https://deepmind.google/models/gemini/ pro/","venue":null,"work_id":"1387d4d7-0992-4695-8c39-1c491882e466","year":2026},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:1a01f58b434ee700f989a7a67fd5c764976d7f9f554ce5a2c8755d262c8466b7","observation_id":"f77d596c-4f38-44c8-8634-43f8a56a958b","resolution":{"observed_at":"2026-05-20T22:24:07.876023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04178","last_updated":"2025-06-05T02:21:52Z","snapshot_observed_at":"2026-08-03T02:41:13.331563Z","submitted_at":"2025-06-04T17:25:39Z","title":"OpenThoughts: Data Recipes for Reasoning Models","version":2},"cited_work":{"arxiv_id":"2506.04178","doi":"10.48550/arxiv.2506.04178","metadata_source":"pith","pith_arxiv_id":"2506.04178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenThoughts: Data Recipes for Reasoning Models","venue":"cs.LG","work_id":"c7acbe41-27a0-4773-a7be-8f08d86cdf21","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2506.04178","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:510b8a9a53d52eaf514f90967daf064761b481b2f61064c36d98de2dd7f393be","observation_id":"7ad1f265-46d6-4070-9ff8-6a16a1c643f1","resolution":{"observed_at":"2026-05-20T22:24:07.778193Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:48.169741+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:48.169741+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:b7e9cc2265127090238726eddec4fea8f8948f77e811f9ba9a538e3195dd5501","observation_id":"bb8caf00-18e3-49f5-83f6-2b8da5d90cde","resolution":{"observed_at":"2026-05-20T22:24:07.786902Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"67d30ea1-8926-4602-aa74-ef51dfd764ef","year":2021},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:eb34d482ac47b1e6331e6920f69fd563507cfa3de2dd2d442a8423204aad0d64","observation_id":"9c1c6649-0ad1-4e81-9bf0-b632dc4c54a5","resolution":{"observed_at":"2026-05-20T22:24:07.867474Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"HMMT.https://www.hmmt.org/","venue":null,"work_id":"4910b0dd-75b3-4998-89fa-d16526e3cb7a","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:8de43d7fc32b22d58de2afd9cbce7d427ae4fb61d7165ea57e2e5ecf95fc5ac5","observation_id":"ea3e4703-0df2-4af1-844c-1df4817614e9","resolution":{"observed_at":"2026-05-20T22:24:07.873193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ad043145-d333-4a56-aaec-7a72f1b84737","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:4b5bfd47b69a25154cd215232d86597480429aa7e1c4d8c8b5e58aab014ee675","observation_id":"63512ddc-8487-4c59-ac47-4d4877d75684","resolution":{"observed_at":"2026-05-20T22:24:07.839437Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.01400","last_updated":"2026-05-07T06:57:24Z","snapshot_observed_at":"2026-08-04T20:04:02.250085Z","submitted_at":"2026-01-04T06:40:25Z","title":"EternalMath: A Living Benchmark of Frontier Mathematics that Evolves with Human Discovery","version":2},"cited_work":{"arxiv_id":"2601.01400","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.01400","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"EternalMath: A Living Benchmark of Frontier Mathematics that Evolves with Human Discovery","venue":"cs.CL","work_id":"ce724c8c-4d73-403a-a50f-2599d720651c","year":2026},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2601.01400","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:e1105dd5252ceddc7d0d8072ae659c0cc2994357f21a194a7f06ef725217ad32","observation_id":"24da91b6-5249-4c59-97b9-e8ff5dde789c","resolution":{"observed_at":"2026-05-20T22:24:07.772977Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"proprietary ai foundation model","venue":null,"work_id":"fc42a98d-8188-4586-8041-26772b39d0ba","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:53e737a4435ee7bf087bf365fea3b73e7ec8a184317ccd57397c8d59c3e41f5a","observation_id":"210423f8-17a3-4993-baa9-a30ced3afdc9","resolution":{"observed_at":"2026-05-20T22:24:07.852027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14249","last_updated":"2026-02-20T04:23:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-24T05:27:46Z","title":"Humanity's Last Exam","version":10},"cited_work":{"arxiv_id":"2501.14249","doi":"10.1038/s41586-025-09962-4","metadata_source":"pith","pith_arxiv_id":"2501.14249","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Humanity's Last Exam","venue":"cs.LG","work_id":"59ea00d4-16a8-45e1-aafc-290a6f91d9f4","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2501.14249","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:445cd9be24c9a1ab85c3d815bd776096ed0a2c4d60ba9f21f801a9fea32170a7","observation_id":"3e7aab8a-d5e1-4247-bed9-e661859d4a38","resolution":{"observed_at":"2026-05-20T22:24:07.747968Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-03T22:08:32.844211+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T22:08:32.844211+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-04T13:37:31.062135Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"cited_work":{"arxiv_id":"2509.26076","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.26076","snapshot_observed_at":"2026-07-10T20:47:34.576528Z","title":"Thomas, and Charles Vial","venue":"cs.CL","work_id":"7313e180-f76c-42c5-b960-70b1f0d0ac40","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2509.26076","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:cc355e2961713b59e5528a358d9aa2d52701be44a6840645d5a04caa964f9b2e","observation_id":"f01528dd-f169-4bd6-a94c-d75730cf07d8","resolution":{"observed_at":"2026-07-10T02:19:32.479333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":"2601.03267","doi":"10.48550/arxiv.2601.03267","metadata_source":"pith","pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI GPT-5 System Card","venue":"cs.CL","work_id":"ca87689a-0d29-4476-b504-b65dbbb08af4","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:7d0d3b489c3ad4116982169ef8c0d1f44b27c4966b3e67922ecade8d4177c473","observation_id":"0df6c967-6835-4223-965c-a391d08ef79c","resolution":{"observed_at":"2026-05-20T22:24:07.782392Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-03T00:38:11.458508+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T00:38:11.458508+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"06638e17-f882-42ac-be06-6683ca673574","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:a19deed3a072da0b21b9bda7c2e15a29b4f43e75c83fdf4db6a98570972cfe65","observation_id":"46a2f3c1-9845-48c5-b610-6870a0bdab0f","resolution":{"observed_at":"2026-05-20T22:24:07.860967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2d66382c-1c30-4b2a-b7d3-096a39026a4d","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:ea7ae588c8124f65fe85d0b3dfd1d84158d0470bf8bfb0794731f940e77160ff","observation_id":"a6f4c571-b33e-4405-8564-4d8cf73e3a66","resolution":{"observed_at":"2026-05-20T22:24:07.836176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02276","last_updated":"2026-02-02T16:17:38Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-02-02T16:17:38Z","title":"Kimi K2.5: Visual Agentic Intelligence","version":1},"cited_work":{"arxiv_id":"2602.02276","doi":"10.48550/arxiv.2602.02276","metadata_source":"pith","pith_arxiv_id":"2602.02276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi K2.5: Visual Agentic Intelligence","venue":"cs.CL","work_id":"d690be8f-5d53-49b0-b1e7-79668eb8fcdb","year":2026},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2602.02276","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:dbc32d77c3881de22fc8169de35df191e4340dbbe76ec3ad151974c9f5b05ffb","observation_id":"9d5056c3-4c56-43c9-8d32-b91ccca28b10","resolution":{"observed_at":"2026-05-20T22:24:07.796186Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:28146cae7e20f8f6ac0ccdf3497ad533bb4d4c1369b77188ea02018ea394fabf","observation_id":"9c77a275-306a-459b-aa16-3ace68a761b8","resolution":{"observed_at":"2026-05-20T22:24:07.800295Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GLM-5.1: Towards Long-Horizon Tasks","venue":null,"work_id":"8bdc39e8-c1e1-4c48-bfb2-1f83a52aa342","year":2026},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:10baa02acfe752167c33c28dd91437092b427f90a076886187c22e34d22e5ddc","observation_id":"c760bdf1-d822-444e-a9e8-b4da826a9d4e","resolution":{"observed_at":"2026-05-20T22:24:07.858204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.13964","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T12:16:56.454637Z","title":"Zhai et al","venue":null,"work_id":"30054851-b83d-4bd9-8155-bd168853f7bd","year":2026},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:d12c28a002edcfc5be214f83aa40ef37b7257944f6386ce6ed5e79c00b050104","observation_id":"32a828db-cc2c-44b5-9c5c-88efc304143e","resolution":{"observed_at":"2026-05-20T22:24:07.828052Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.12575","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T16:38:40.589477Z","title":"Sovereign AI Foundation Model","venue":null,"work_id":"30349c39-f498-489c-9498-0783c72a9dbc","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:ec9211f42c04e249dd330de387912914eff4468b0cbe84ba0cf98ad4f3aa5ef2","observation_id":"f32425d4-8502-4362-86f0-a681301cb3fe","resolution":{"observed_at":"2026-05-20T22:24:07.818261Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":7,"verified_exact":16,"verified_fuzzy":7},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 2 inbound Pith citation observations for arXiv:2605.09063."}