{"as_of":"2026-08-09T07:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d88698ab836c15ef511ba7224745fb47bf4b7af58cc2510898156aa07f71f398","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:14:40.383156Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01804/citation-record","integrity":"/paper/2608.01804/integrity","json":"/paper/2608.01804/citation-record.json","paper":"/paper/2608.01804"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.02089","last_updated":"2025-02-18T11:39:46Z","snapshot_observed_at":"2026-07-06T19:26:38.002071Z","submitted_at":"2024-10-02T23:25:17Z","title":"RLEF: Grounding Code LLMs in Execution Feedback with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02089","snapshot_observed_at":"2026-08-07T00:14:38.260775Z","title":"Jonas Gehring, Kunhao Zheng, Jade Copet, Vegard Mella, Quentin Carbonneaux, Taco Cohen, and Gabriel Synnaeve","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.260775Z"},"links":{"cited_paper":"/paper/2410.02089","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:8690cf4529e1348baeabde98ccd2bea574d74661fa57e53817800503a3c51a15","observation_id":"4b0e5296-46c0-4996-9f78-40f3af77103c","resolution":{"observed_at":"2026-08-07T00:14:38.260775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17746","last_updated":"2025-10-03T01:55:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-23T17:57:55Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17746","snapshot_observed_at":"2026-08-07T00:14:38.347899Z","title":"Rubrics as rewards: Reinforcement learning beyond verifiable domains.arXiv preprint arXiv:2507.17746,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.347899Z"},"links":{"cited_paper":"/paper/2507.17746","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:51b5d9a51ec7f2c7795741e4cc4277471871683b198e867950f74b5f2bb0778e","observation_id":"2564e9df-8411-4ba3-a91f-e2cfd227ce72","resolution":{"observed_at":"2026-08-07T00:14:38.347899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.12790","last_updated":"2025-08-18T10:06:08Z","snapshot_observed_at":"2026-08-05T19:15:41.254461Z","submitted_at":"2025-08-18T10:06:08Z","title":"Reinforcement Learning with Rubric Anchors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.12790","snapshot_observed_at":"2026-08-07T00:14:38.445310Z","title":"Arnav Kumar Jain, Gonzalo Gonzalez-Pumariega, Wayne Chen, Alexander M Rush, Wenting Zhao, and Sanjiban Choudhury","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.445310Z"},"links":{"cited_paper":"/paper/2508.12790","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:5367035e440c586558367c5f491f1028e67123d9ce6cf7040795abeae086a0dc","observation_id":"5ef81299-f809-4b3c-8eaf-dc99e5af92e2","resolution":{"observed_at":"2026-08-07T00:14:38.445310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:38.546266Z","title":"Reveal: Self-evolving code agents via reliable self-verification.arXiv preprint arXiv:2506.11442,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.546266Z"},"links":{"citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:fcf30e03c6269d1c990453eaf1e58c8b510534ea057ce4ec4fdb6b02766f4e28","observation_id":"56f4a5a0-6596-492e-81d2-500366102545","resolution":{"observed_at":"2026-08-07T00:14:38.546266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14111","last_updated":"2026-08-05T22:03:49Z","snapshot_observed_at":"2026-08-09T07:09:08.787915Z","submitted_at":"2025-07-18T17:43:56Z","title":"CUDA-L1: Improving CUDA Optimization via Contrastive Reinforcement Learning","version":12},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14111","snapshot_observed_at":"2026-08-07T00:14:38.778592Z","title":"Cuda-l1: Improving cuda optimization via contrastive reinforcement learning.arXiv preprint arXiv:2507.14111,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.778592Z"},"links":{"cited_paper":"/paper/2507.14111","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:513d666581f025ebaf89f9427d8f9b755c7cd5f7bda436a851f80a8a5c344799","observation_id":"39c2a086-d479-403e-9c5a-37aa61e6dba7","resolution":{"observed_at":"2026-08-07T00:14:38.778592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-07T00:14:39.097324Z","title":"Understanding r1-zero-like training: A critical perspective.arXiv preprint arXiv:2503.20783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.097324Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:472c788a8dd70142bd4914ce469fe6ded68a898ce5a3b56d78f79fc4cc2c9b06","observation_id":"4234a704-7a43-4fcb-a77e-432e94646b85","resolution":{"observed_at":"2026-08-07T00:14:39.097324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-07T00:14:39.265466Z","title":"Starcoder 2 and the stack v2: The next generation.arXiv preprint arXiv:2402.19173,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.265466Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:fa180e3dc06b328a77b0d72df321e10e2afde66fbcfed0e651e1f94543e930e7","observation_id":"d0006dbf-00a7-4acc-ab6f-df68a9b7958c","resolution":{"observed_at":"2026-08-07T00:14:39.265466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10517","last_updated":"2025-02-14T19:30:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T19:30:53Z","title":"KernelBench: Can LLMs Write Efficient GPU Kernels?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10517","snapshot_observed_at":"2026-08-07T00:14:39.414794Z","title":"Ker- nelbench: Can llms write efficient gpu kernels?arXiv preprint arXiv:2502.10517,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.414794Z"},"links":{"cited_paper":"/paper/2502.10517","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:65fcbf9c6b7d5aaad3f01df3c7fd0c0dcdd49bd95ed6e44ab7929efe35704d6b","observation_id":"0b2cde1c-1b24-413f-a027-d432e7ec604e","resolution":{"observed_at":"2026-08-07T00:14:39.414794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T00:14:39.532200Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.532200Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:76198f710bbb98361fe853b0f8bace672a33db01f5edc653cd760e6a869ec38a","observation_id":"54b62edc-d276-476e-89d1-a7de19a0f35e","resolution":{"observed_at":"2026-08-07T00:14:39.532200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-08-07T00:14:39.834527Z","title":"Kimi k2: Open agentic intelligence.arXiv preprint arXiv:2507.20534,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.834527Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:401ea4c441211364f3d5cc02dae6c82d95595d7173df0d27b9faa2e0d50b0f36","observation_id":"0a58342c-d794-4fbf-bb55-52ea57917e14","resolution":{"observed_at":"2026-08-07T00:14:39.834527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02120","last_updated":"2024-06-07T02:50:56Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:50:35Z","title":"Magicoder: Empowering Code Generation with OSS-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02120","snapshot_observed_at":"2026-08-07T00:14:39.998379Z","title":"Magicoder: Empowering code generation with oss-instruct.arXiv preprint arXiv:2312.02120,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.998379Z"},"links":{"cited_paper":"/paper/2312.02120","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:948de64c887b87749ca1e527ae7f7f05cecfa1ce67af7ebfd6744c7b66f3bc77","observation_id":"32bfd783-1301-4b4f-9eee-22a65c346839","resolution":{"observed_at":"2026-08-07T00:14:39.998379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02780","last_updated":"2026-01-08T05:52:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-06T07:31:47Z","title":"MiMo-V2-Flash Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.02780","snapshot_observed_at":"2026-08-07T00:14:40.119134Z","title":"Mimo-v2-flash technical report.arXiv preprint arXiv:2601.02780,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:40.119134Z"},"links":{"cited_paper":"/paper/2601.02780","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:3ee1b683ca42739983088a7a17a79b871350d6e031cf2772d690cbcd710901c2","observation_id":"e0d68600-e5c4-403b-a434-0cc001641b6b","resolution":{"observed_at":"2026-08-07T00:14:40.119134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:41.115082Z","title":"Kodcode: A diverse, challenging, and verifiable synthetic dataset for coding","venue":null,"work_id":"474c12a0-fd79-491e-821a-903ae6750945","year":2025},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:40.126059Z"},"links":{"citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:9f75b2c5a5124be914d9d203b7902c8601cfb307ab47096f02c649e644cc71d0","observation_id":"0bf33520-9fc8-41e6-8c90-0ba4146f3059","resolution":{"observed_at":"2026-08-07T00:14:41.196047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T00:14:40.175694Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:40.175694Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:4530d26e81f5f6a9059ac4324289cd7eaa196a4a6ad7878745842d28a6e3c1a6","observation_id":"8718100a-9498-49fc-9ecf-19a4602aad3e","resolution":{"observed_at":"2026-08-07T00:14:40.175694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05118","last_updated":"2025-04-11T02:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T14:21:11Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05118","snapshot_observed_at":"2026-08-07T00:14:40.240344Z","title":"Vapo: Efficient and reliable reinforcement learning for advanced reasoning tasks.URL https://arxiv","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:40.240344Z"},"links":{"cited_paper":"/paper/2504.05118","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:60d72f7269c530023d6f2713e14c2b284e23139fa743f9ac4a4938760d4415da","observation_id":"a14fd13b-69db-4100-8de4-068ed528d308","resolution":{"observed_at":"2026-08-07T00:14:40.240344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-07T00:14:40.307397Z","title":"Glm-5: from vibe coding to agentic engineering.arXiv preprint arXiv:2602.15763,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:40.307397Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:b66a7277996fbc63df8b9a597e43095a88dd5ad084eefcaa6b5069abf3351cf6","observation_id":"5b85acec-c6e0-4e02-9496-c7c4004362dc","resolution":{"observed_at":"2026-08-07T00:14:40.307397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18071","last_updated":"2025-07-28T11:11:33Z","snapshot_observed_at":"2026-08-06T04:31:03.113409Z","submitted_at":"2025-07-24T03:50:32Z","title":"Group Sequence Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.18071","snapshot_observed_at":"2026-08-07T00:14:40.383156Z","title":"Group sequence policy optimization.arXiv preprint arXiv:2507.18071,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:40.383156Z"},"links":{"cited_paper":"/paper/2507.18071","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:984b929da3b29fd078e2afc83dfe1e10290b1c1e26100d8f0c9a0f4591d233cb","observation_id":"ea9a0ebb-dcb4-4436-856d-c7534c2aee98","resolution":{"observed_at":"2026-08-07T00:14:40.383156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-07T00:14:39.656558Z","title":"Hybridflow: A flexible and efficient rlhf framework.arXiv preprint arXiv: 2409.19256,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:39.656558Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:576fa8733b19066ed68550e5eddd09675df6adb29ed0c6f7ec4b497b75a762fb","observation_id":"3e3f3bbe-4b24-453e-a60f-871f4f1975d5","resolution":{"observed_at":"2026-08-07T00:14:39.656558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.04847","last_updated":"2026-06-03T13:15:30Z","snapshot_observed_at":"2026-08-08T23:31:42.863740Z","submitted_at":"2026-06-03T13:15:30Z","title":"MusaCoder: Native GPU Kernel Generation with Full-Stack Training on Moore Threads GPU","version":1},"cited_work":{"arxiv_id":"2606.04847","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.04847","snapshot_observed_at":"2026-08-07T00:14:40.952443Z","title":"MusaCoder: Native GPU Kernel Generation with Full-Stack Training on Moore Threads GPU","venue":"cs.CV","work_id":"88936c8e-c05b-465e-a712-e2d062b85e47","year":2026},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:37.966451Z"},"links":{"cited_paper":"/paper/2606.04847","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:1b52ac01e176e435ec64cb03bd8fcfd7910eaed47c33b30d04cf01141fa36a42","observation_id":"88217968-cbb4-4fbc-802a-1e4e6990bbe8","resolution":{"observed_at":"2026-08-07T00:14:41.018986Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:38.925443Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.925443Z"},"links":{"citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:30d363aed95aedda13787b474916edbc92e5c23483a40c1d6a458786286129d6","observation_id":"214ad3cc-1331-461f-be12-d4f35a935a5b","resolution":{"observed_at":"2026-08-07T00:14:38.925443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T00:14:37.907102Z","title":"Program synthesis with large language models.arXiv preprint arXiv:2108.07732,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:37.907102Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:b951e3faecae9031a809aae14f2054689ab6cfdbc0772cc747207674dddcbbee","observation_id":"af69c148-4d9f-48a6-8c5b-992d3c69eff3","resolution":{"observed_at":"2026-08-07T00:14:37.907102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:38.071821Z","title":"Cuda agent: Large-scale agentic rl for high-performance cuda kernel generation.arXiv preprint arXiv:2602.24286,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.071821Z"},"links":{"citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:32cefa39b4317d957d23b9a49285bad1306da5036318a1d03e00c04020da45cf","observation_id":"0d6e8044-d512-486e-ae7a-42d856a596ea","resolution":{"observed_at":"2026-08-07T00:14:38.071821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:41.284115Z","title":"Chanakya Ekbote, Vijay Lingam, Behrooz Omidvar Tehrani, Jun Huan, Sujay Sanghavi, Anoop Deoras, and Stefano Soatto","venue":null,"work_id":"f18c04f3-79f1-44d0-bbeb-ba137866833b","year":2026},"citing_paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:38.181783Z"},"links":{"citing_paper":"/paper/2608.01804"},"observation_digest":"sha256:472ce37e38590bb50b0c8039d2c21fc94f6f73dd030e5a527b6ec1b893703968","observation_id":"1f6446a1-34a0-4d75-a3f3-3ac18298b60d","resolution":{"observed_at":"2026-08-07T00:14:41.363450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01804","last_updated":"2026-08-04T02:24:08Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T23:03:25.990749Z","submitted_at":"2026-08-03T07:12:52Z","title":"LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2608.01804."}