{"as_of":"2026-08-10T00:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7869e9b99873971a0fc95bfbd25ba19b9e20c9653373618c1e9b9da38572fff4","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:35:02.149902Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T09:22:06.285118Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T09:23:10.509262Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"cited_work":{"arxiv_id":"2506.04894","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04894","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Icpc-Eval: Probing the frontiers of LLM reasoning with competitive programming contests","venue":null,"work_id":"df5398e9-b201-40b0-afb0-f0a0ec09947e","year":2025},"citing_paper":{"arxiv_id":"2605.08905","last_updated":"2026-05-09T11:57:25Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T11:57:25Z","title":"Forge: Quality-Aware Reinforcement Learning for NP-Hard Optimization in LLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-12T02:44:33.143247Z"},"links":{"cited_paper":"/paper/2506.04894","citing_paper":"/paper/2605.08905"},"observation_digest":"sha256:8e98c7a7a0afdf15d8653480403850250451d2afac0d4a758d14f90814670d11","observation_id":"e4539fd5-b99d-4d9f-a2a4-64a894d074c0","resolution":{"observed_at":"2026-05-12T02:46:18.912715Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"cited_work":{"arxiv_id":"2506.04894","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04894","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Icpc-Eval: Probing the frontiers of LLM reasoning with competitive programming contests","venue":null,"work_id":"df5398e9-b201-40b0-afb0-f0a0ec09947e","year":2025},"citing_paper":{"arxiv_id":"2605.18073","last_updated":"2026-05-18T08:55:30Z","snapshot_observed_at":"2026-07-06T23:28:59.503300Z","submitted_at":"2026-05-18T08:55:30Z","title":"A-ProS: Towards Reliable Autonomous Programming Through Multi-Model Feedback","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T09:22:06.285118Z"},"links":{"cited_paper":"/paper/2506.04894","citing_paper":"/paper/2605.18073"},"observation_digest":"sha256:d912464a9cb77b24796c0798ee68724434adef40850f53169c51144704dc9572","observation_id":"cd3847b9-467e-4bdf-bfa5-13c1fb21692a","resolution":{"observed_at":"2026-05-20T09:23:10.510877Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04894/citation-record","integrity":"/paper/2506.04894/integrity","json":"/paper/2506.04894/citation-record.json","paper":"/paper/2506.04894"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T10:35:02.064673Z","title":"A Survey of Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.064673Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:53dcaeae71a90ee45251337a93710a4b36a45475f14e438d6e50211ca170df45","observation_id":"e77ef952-976b-4ba7-94ab-d1b4ac2d1122","resolution":{"observed_at":"2026-08-07T10:35:02.064673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.397695Z","title":"https://openai.com/o1/, 2024","venue":null,"work_id":"2aaf1cef-fcaf-47e0-915b-c62dd77b0cf7","year":2024},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.068921Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:1524f0462417963f1f344e23f01aa6a48846f8f9c81adcb6f4e982b3fd65c191","observation_id":"26129e3c-be2f-4187-b8b5-68cf2eba32cc","resolution":{"observed_at":"2026-08-07T10:35:02.400755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T10:35:02.072166Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.072166Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:93f0bb5f5fb2ea8761c4bb71ee42ad637c072da624a143fbe014c3e2cb39423d","observation_id":"ee4e85c7-7869-4b11-a110-3191341deefd","resolution":{"observed_at":"2026-08-07T10:35:02.072166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.387381Z","title":null,"venue":null,"work_id":"1cbad936-b05a-4a38-8764-289a1a02ee85","year":null},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.075898Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:30f7bb5b3a0d560c88973c8c1433b1b43309b3bb2f68e9c523b7f3b2d3db71ab","observation_id":"8297e588-252c-468d-9eac-ec1d5cc78065","resolution":{"observed_at":"2026-08-07T10:35:02.390764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-07T10:35:02.078965Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.078965Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:d637daa7a6687626079a562c66b8948d3e9e8e52129b7d036e46b911eb5e83b5","observation_id":"3f1773dd-1287-4e9a-be38-143068c21443","resolution":{"observed_at":"2026-08-07T10:35:02.078965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10952","last_updated":"2024-04-16T23:27:38Z","snapshot_observed_at":"2026-08-07T05:16:48.851507Z","submitted_at":"2024-04-16T23:27:38Z","title":"Can Language Models Solve Olympiad Programming?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10952","snapshot_observed_at":"2026-08-07T10:35:02.083166Z","title":"Can Language Models Solve Olympiad Programming? (arXiv:2404.10952), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.083166Z"},"links":{"cited_paper":"/paper/2404.10952","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:18048e38425d2c019842fabb13b491335fc21edfce06d2a4c25bb4599efbfd13","observation_id":"0153c955-1265-4112-80d0-b32548f7555f","resolution":{"observed_at":"2026-08-07T10:35:02.083166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01257","last_updated":"2025-01-03T16:36:12Z","snapshot_observed_at":"2026-07-31T19:08:41.925451Z","submitted_at":"2025-01-02T13:49:00Z","title":"CodeElo: Benchmarking Competition-level Code Generation of LLMs with Human-comparable Elo Ratings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01257","snapshot_observed_at":"2026-08-07T10:35:02.087340Z","title":"CodeElo: Benchmarking Competition-level Code Generation of LLMs with Human-comparable Elo Ratings","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.087340Z"},"links":{"cited_paper":"/paper/2501.01257","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:dfb7532331522fbc5ba6c839f5097bb8ea1d2b33e82304e11c12f5314a147376","observation_id":"7d8cdb37-b2b4-48b3-9ac1-14879d128c64","resolution":{"observed_at":"2026-08-07T10:35:02.087340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11366","last_updated":"2023-10-10T05:21:45Z","snapshot_observed_at":"2026-07-06T15:05:53.556198Z","submitted_at":"2023-03-20T18:08:50Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11366","snapshot_observed_at":"2026-08-07T10:35:02.091598Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.091598Z"},"links":{"cited_paper":"/paper/2303.11366","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:b0128a1730dea55d8ac5d2d0a11698ba80ea8a53720fc51140e8ddb0ed5f2ef9","observation_id":"88feea31-4c79-4398-9151-0cb66d8085c7","resolution":{"observed_at":"2026-08-07T10:35:02.091598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.376727Z","title":null,"venue":null,"work_id":"4cd6367c-e9a7-46f4-b240-2df5188c5078","year":null},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.095896Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:fa3a828d97d588785f4a4f2962a17c08aa396c612ca113e48f41b4825234b5d9","observation_id":"ff232cf5-5847-4411-a246-d0c2a69f316f","resolution":{"observed_at":"2026-08-07T10:35:02.379835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T10:35:02.099581Z","title":"Program synthesis with large language models.arXiv preprint arXiv:2108.07732, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.099581Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:374b94ee97d246263ecd731ac441853d25a5d9140f593dae548f964d4cc3a52b","observation_id":"b71aa269-6c29-43ee-8021-8794b2ccca8a","resolution":{"observed_at":"2026-08-07T10:35:02.099581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.09938","last_updated":"2021-11-08T21:16:44Z","snapshot_observed_at":"2026-08-04T23:13:25.514661Z","submitted_at":"2021-05-20T17:58:42Z","title":"Measuring Coding Challenge Competence With APPS","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.09938","snapshot_observed_at":"2026-08-07T10:35:02.102815Z","title":"Measuring Coding Challenge Competence With APPS","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.102815Z"},"links":{"cited_paper":"/paper/2105.09938","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:69ff9f5abce048ef8f0c6272b9370a4fa65f8c3159bb99daefba911df99acb95","observation_id":"6cf597c2-5c45-42d9-bec7-0a2af91442fe","resolution":{"observed_at":"2026-08-07T10:35:02.102815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.367116Z","title":"Mankowitz, Esme Sutherland Robson, Pushmeet Kohli, Nando de Freitas, Koray Kavukcuoglu, and Oriol Vinyals","venue":null,"work_id":"3f5159cd-e39e-4560-a61e-ac8c83b0f7bb","year":2022},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.106739Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:68bfbc2a09e23c5d90d31a499f91c8d75b818976257193bbc84745007968d54c","observation_id":"857463fc-6d53-45ae-bf67-fbd019d0a77c","resolution":{"observed_at":"2026-08-07T10:35:02.370461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03004","last_updated":"2023-11-06T07:16:58Z","snapshot_observed_at":"2026-07-06T14:59:03.634181Z","submitted_at":"2023-03-06T10:08:51Z","title":"xCodeEval: A Large Scale Multilingual Multitask Benchmark for Code Understanding, Generation, Translation and Retrieval","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03004","snapshot_observed_at":"2026-08-07T10:35:02.109846Z","title":"Saiful Bari, Xuan Long Do, Weishi Wang, Md Rizwan Parvez, and Shafiq Joty","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.109846Z"},"links":{"cited_paper":"/paper/2303.03004","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:cad9c1537ebd3746a6f70309a655a1b6ea10a74164934212bb88684e630ce2f1","observation_id":"313fd987-6613-4c39-8bd6-c6425ed2de53","resolution":{"observed_at":"2026-08-07T10:35:02.109846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-07T10:35:02.113373Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.113373Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:935ac7ed23988ff6e08e70d9475234b0d8f12dec9d22c3018ade696b5c6131a3","observation_id":"20962425-cee4-4456-8526-4482cde1277e","resolution":{"observed_at":"2026-08-07T10:35:02.113373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.357294Z","title":"Multi-turn rl training for cuda kernel generation","venue":null,"work_id":"ce0b3a41-950b-464b-aa06-fb00b14d52b9","year":null},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.117383Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:c8983fc5ec8ca3b126e29a9e61659b8e6850a080487bf203e9f990353eaa4fb2","observation_id":"64625227-ca3c-4f83-aa9e-2cf775e2a563","resolution":{"observed_at":"2026-08-07T10:35:02.360452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09896","last_updated":"2024-02-02T18:31:34Z","snapshot_observed_at":"2026-08-06T10:06:10.773161Z","submitted_at":"2023-06-16T15:13:17Z","title":"Is Self-Repair a Silver Bullet for Code Generation?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09896","snapshot_observed_at":"2026-08-07T10:35:02.120455Z","title":"Olausson, Jeevana Priya Inala, Chenglong Wang, Jianfeng Gao, and Armando Solar-Lezama","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.120455Z"},"links":{"cited_paper":"/paper/2306.09896","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:5c16e01e5f65c8539d957dcf16e3029c3edbc447aa7285f619183666c90297d8","observation_id":"ac9e268a-8594-43a4-8285-48859606379a","resolution":{"observed_at":"2026-08-07T10:35:02.120455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14658","last_updated":"2025-01-07T05:37:04Z","snapshot_observed_at":"2026-08-06T03:14:31.781649Z","submitted_at":"2024-02-22T16:06:23Z","title":"OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14658","snapshot_observed_at":"2026-08-07T10:35:02.124225Z","title":"OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.124225Z"},"links":{"cited_paper":"/paper/2402.14658","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:881844f1f53e4423314987f99a29994e8805870c9eec1af61531d860ba5a8370","observation_id":"b1e36e96-768f-4d86-a294-6eddbee9cf53","resolution":{"observed_at":"2026-08-07T10:35:02.124225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.346741Z","title":"SPoC: Search-based Pseudocode to Code","venue":null,"work_id":"e2bb48bf-3747-4083-8c48-a55e67b02bde","year":null},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.127317Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:9ef958cfb8d1df33bd935ff34c52a914a819b1c55d2c2cccb79c905764bde10a","observation_id":"003e6e37-0338-4fdb-989d-6c79e5794682","resolution":{"observed_at":"2026-08-07T10:35:02.350049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11354","last_updated":"2025-04-15T16:23:44Z","snapshot_observed_at":"2026-08-03T03:38:06.953412Z","submitted_at":"2025-04-15T16:23:44Z","title":"Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11354","snapshot_observed_at":"2026-08-07T10:35:02.130547Z","title":"Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.130547Z"},"links":{"cited_paper":"/paper/2504.11354","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:bd77bbf1cfb99e8b33964ab6d50f694aa3c34acbecdb2f9b662e0f49e965465e","observation_id":"141f6732-d71d-414f-a849-015d7191659a","resolution":{"observed_at":"2026-08-07T10:35:02.130547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.336224Z","title":null,"venue":null,"work_id":"874dcd53-1445-4591-9743-8c7a55d12dd4","year":null},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.134377Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:1c97a7a255413ffcd95b8b8e0063fa50755dd887e1407d1f3b06a04ad985bc42","observation_id":"bcb97050-bb2e-477c-914b-4236db4aa6d2","resolution":{"observed_at":"2026-08-07T10:35:02.339445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.324725Z","title":"QwQ-32b: Embracing the power of reinforcement learning, March 2025","venue":null,"work_id":"e1d37750-20d5-4db3-8727-6231d5d5bd8d","year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.138061Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:acc6d695957cb03fbba82e020b65a945038cb63af973291f4592dcb9ffa0574d","observation_id":"80de60c8-3f66-40a9-913c-4d607dae410c","resolution":{"observed_at":"2026-08-07T10:35:02.328705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04548","last_updated":"2025-03-06T15:34:27Z","snapshot_observed_at":"2026-08-07T17:24:22.925386Z","submitted_at":"2025-03-06T15:34:27Z","title":"An Empirical Study on Eliciting and Improving R1-like Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04548","snapshot_observed_at":"2026-08-07T10:35:02.142063Z","title":"An empirical study on eliciting and improving r1-like reasoning models.arXiv preprint arXiv:2503.04548, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.142063Z"},"links":{"cited_paper":"/paper/2503.04548","citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:aac34e674c0bb3ae95dd5f0342a746ebde94f3709058c0c98cc151bc78610393","observation_id":"91706d69-cc3c-4652-96bf-4e1f55e08da2","resolution":{"observed_at":"2026-08-07T10:35:02.142063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.314795Z","title":null,"venue":null,"work_id":"64800f67-8cfa-4960-9a82-4af86588c2af","year":null},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.146268Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:5cad0aff3d88f68e8fd577b42ec353b3691911387352f060a77d2191fc136033","observation_id":"fa1eb5f7-65cb-4f62-883a-f2706f29a21f","resolution":{"observed_at":"2026-08-07T10:35:02.317935Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:35:02.303668Z","title":"Category1EnglishName","venue":null,"work_id":"9782f6b0-2870-4c44-a4d9-fe2c131aa5ed","year":2023},"citing_paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:02.149902Z"},"links":{"citing_paper":"/paper/2506.04894"},"observation_digest":"sha256:98faf9b473aece55698e7e194e2f3bda26807d4a1d040eb02126da1cd84c3270","observation_id":"49a4dd87-d001-41d3-b3c7-cd905c9f2adf","resolution":{"observed_at":"2026-08-07T10:35:02.307798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.04894","last_updated":"2025-06-05T11:20:37Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T04:58:40.515829Z","submitted_at":"2025-06-05T11:20:37Z","title":"ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 2 inbound Pith citation observations for arXiv:2506.04894."}